漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Resect AI 获 2500 万美元融资,开发开源技术提前拦截 AI 幻觉

据 GeekWire 报道,AI 初创公司 Resect AI 宣布结束隐身状态,并获得私募股权投资者 2500 万美元融资。该公司专注于开发开源技术,目标是在 AI 幻觉发生之前进行捕获和阻断,而非在错误内容生成后再做修正。随着大语...

Read More
2026-09-04 talkingdev

Gimlet Labs获a16z领投3亿美元、估值30亿,异构AI芯片任务分配成资本新宠

彭博社消息,Gimlet Labs完成由a16z领投的3亿美元新一轮融资,投后估值达到30亿美元。值得注意的是,该公司六个月前刚完成8000万美元A轮融资,估值与融资额均快速跳升。Gimlet Labs的核心方向是将AI计算任务拆分并调...

Read More
2026-09-03 talkingdev

Val Town:多数 Pro 推荐来自 AI,文档页正成为捕获 AI 代理的复杂查询

随着传统搜索流量持续下降,Val Town 发现其 Pro 订阅的已知推荐现在大多来自 AI 模型,这促使团队将重心转向答案引擎优化(AEO)。其早期策略并非大规模生成面向机器的内容,而是先量化不同模型的推荐与引用表现,...

Read More
2026-09-03 talkingdev

GitHub Copilot 成本优化揭秘:为何更短的输出反而更贵,如何不牺牲任务质量

GitHub 近期分享了一个反直觉的发现:在 AI 编码代理中,单纯缩短单个工具输出未必能降低成本,反而可能推高总开销。原因在于,当输出缺乏必要上下文时,模型会被迫重新打开文件、重新运行命令或增加额外对话轮次,...

Read More
2026-09-03 talkingdev

谷歌发布 Gemini 3.8 Flash 与 Flash Cyber:智能体推理和网络安全能力再升级

谷歌近日正式推出 Gemini 3.8 Flash,这一新模型在编程、智能体工作流和多步推理方面均有显著提升,同时延续了与 3.7 Flash 相同的入门定价,意味着开发者可以在不增加成本的情况下获得更强的任务执行能力。值得关注...

Read More
2026-09-03 talkingdev

Test-Time Training:测试时训练有望成为大模型新扩展轴,持续学习仍是难题

模型开发领域,“新扩展轴”往往意味着一次能力跃升。从扩大参数规模到扩大数据规模,行业每开辟一条新扩展路径,都会带来模型效果的显著提升。测试时训练(Test-Time Training)正被视为一个极具吸引力的新扩展轴:...

Read More
2026-09-03 talkingdev

Meta超级应用Muse即将发布:Ava模型测试计算机使用能力

Meta正在加速推进其AI代理超级应用项目,该项目内部代号为Project Hatch,正式发布名称已确定为Muse。目前iOS端应用已开放等待列表,桌面应用中也新增了“computer use”设置入口。更值得关注的是,Meta似乎在内部测试...

Read More
2026-09-01 talkingdev

Claude Code Opus 5 Auto Mode遭提示注入突破:代码执行成功率高达80%

近期安全研究显示,Claude Code Opus 5 的 Auto Mode(自动模式)存在提示注入攻击风险。攻击者通过构造简单的网站摘要请求,即可劫持自动模式下的编码代理,并在实测中实现代码执行,攻击成功率达到60%至80%。这一...

Read More
  1. Prev Page
  2. 2
  3. 3
  4. 4
  5. Next Page