漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-17 talkingdev

Codex辅助自动研究:GPU Mode qr_v2问题实现232倍内核加速

在近期一场聚焦GPU优化的自动研究竞赛中,参赛者针对批量方阵compact-Householder QR分解(qr_v2)问题展开优化,最终在GPU Mode的qr_v2任务上实现了相对基线高达232倍的内核加速,并在183名参与者中位列第12。该项...

Read More
2026-08-17 talkingdev

GLM-5.3问世:中国AI实验室何以把发布周期从“月”压缩到“天”?

近日,Z.ai发布GLM-5.3引发关注。与此前OpenAI、Anthropic动辄数月的发布节奏不同,Z.ai的模型迭代周期可能仅以天计。尽管美国头部实验室内部模型或许更强,但其公开释放速度明显偏慢。报道指出,Z.ai更重视公共基准...

Read More
2026-08-17 talkingdev

Stripe被曝将以超70亿美元收购AI模型路由平台OpenRouter

据TechCrunch报道,Stripe已同意以超过70亿美元的价格收购AI模型路由初创公司OpenRouter。OpenRouter为开发者提供统一的模型网关,能够根据模型能力、价格等因素在不同大模型之间智能路由请求,帮助企业灵活调用多家...

Read More
2026-08-17 talkingdev

AI视频生成创企Higgsfield融资4亿美元:估值从1月13亿飙升至54亿美元

AI视频生成初创公司Higgsfield宣布完成4亿美元新一轮融资,投资方包括DST、高盛、Liberty Global、英特尔等机构,投后估值达到54亿美元。该轮融资前,公司估值在1月为13亿美元,短短数月内增长超过三倍,显示市场对A...

Read More
2026-08-14 talkingdev

空货架还是丢钥匙?谷歌研究:GPT-5与Gemini 3事实性错误的瓶颈在“回忆”

大模型事实性错误常被简单归因为训练知识不足,但谷歌研究团队通过知识画像框架对Gemini 3、GPT-5等先进模型进行分析后发现,模型对事实知识的编码已接近饱和,真正的瓶颈出现在参数化回忆阶段。也就是说,模型并非...

Read More
2026-08-14 talkingdev

Mistral发布OCR 4.1:面向复杂文档的视觉多模态模型,直接输出JSON/Markdown

Mistral AI 正式发布 OCR 4.1,这是一款高度专用的视觉多模态模型,核心目标是摄取、解析并结构化复杂文档格式。该模型在复杂表格布局识别、层级文档结构理解方面表现突出,能够直接输出干净且机器可读的 JSON 或 Ma...

Read More
2026-08-14 talkingdev

OpenAI发布GPT-5.6 Sol超高速模式:推理速度最高提升14倍,每秒输出750 tokens

OpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...

Read More
2026-08-13 talkingdev

Adapt 提出“Build Wide, Ship Narrow”AI辅助开发新范式:先宽构建,后窄交付

Adapt 在最新博客中提出一种面向AI辅助开发的新工程范式“Build Wide, Ship Narrow”(宽构建、窄交付)。传统开发流程要求在编码前紧密规划功能边界,而新方法鼓励先进行更广泛的初始构建,再借助AI工具迭代细化。团...

Read More
  1. Prev Page
  2. 4
  3. 5
  4. 6
  5. Next Page