漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-28 talkingdev

fal 推出 H3 Max:MiniMax H3 后训练版最快 3 秒生成 5 秒视频,综合质量登顶

fal Research 宣布推出 H3 Max,这是 MiniMax H3 的后训练版本,由 fal 推理团队专门针对生成速度进行优化。官方表示,该模型可在不到 3 秒内生成一段 5 秒长的视频,显著降低视频生成等待时间。在人类偏好评估中,H...

Read More
2026-08-28 talkingdev

Anthropic 推出 Model Hardware Standard(MHS)研究预览:让 AI 智能体安全操作物理设备

Anthropic 宣布开放 Model Hardware Standard(MHS)研究预览,这是一项模型无关的硬件交互规范,旨在让 AI 智能体能够安全地操作科学研究和先进制造设备。该标准首批面向科学研究实验室与先进制造商,试图为 AI 代...

Read More
2026-08-28 talkingdev

Cohere发布Parse文档智能模型:支持9种语言,每千页仅1.5美元

Cohere 推出 Parse 文档智能解析服务,可将复杂多模态文件(如文档、表格、图像)转换为结构化、机器可读的数据。该服务基于高成本效益的视觉语言模型,面向企业大规模文档处理场景,能够检测并理解关键视觉元素,并...

Read More
2026-08-27 talkingdev

Trail of Bits 最新测试:虚拟机已无法困住具备网络攻击能力的 AI 智能体

Trail of Bits 的最新测试显示,具备网络攻击能力的先进 AI 智能体已能迅速突破传统虚拟机隔离。研究人员指出,这些智能体不仅能利用主机系统已公开的漏洞,还能发现并利用未知漏洞实现逃逸,使“仅靠 VM 隔离即可遏...

Read More
2026-08-27 talkingdev

DuckDB与数据分析“物理学”的变革:AWS收购DuckLabs背后的技术信号

近年来,以DuckDB为代表的嵌入式分析引擎正在改变数据处理的基本范式。过去,大规模数据分析往往依赖由多台机器组成的分布式系统,以应对数据量和计算复杂度的挑战。然而,随着单机硬件性能的显著提升,尤其是内存容...

Read More
2026-08-27 talkingdev

Meta推出Muse Image图像生成模型:先推理后渲染,单图成本仅0.01美元

Meta推出的Muse Image图像生成模型,其核心特点在于能够基于搜索结果进行图像生成,并在最终渲染前执行推理过程。这意味着模型不再仅依赖训练数据中的视觉模式,而是可以结合外部信息来约束生成结果,有望提升图像的...

Read More
2026-08-27 talkingdev

谷歌发布Gemini 3.5 Transcribe:智能语音转写进入格式化新时代

谷歌正式推出Gemini 3.5 Transcribe,这是面向智能语音交互场景的新一代语音转文本模型。它能够将原始音频直接转换为准确、经过润色并完成格式化的文本,减少用户在后期整理和编辑上的工作量。该模型现已在Gemini AP...

Read More
2026-08-27 talkingdev

突发:ChatGPT 正式支持 WebMCP,智能体网络再进一步

OpenAI 已在其 ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 中支持 WebMCP。WebMCP 可视为将模型上下文协议(MCP)思路引入网页环境:网站能够以标准化方式向 AI 智能体暴露工具、数据或操作能力。对 ChatGPT 和...

Read More
  1. Prev Page
  2. 9
  3. 10
  4. 11
  5. Next Page