漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-22 talkingdev

阿里巴巴CEO吴泳铭:将训练5万亿至10万亿参数AI大模型,全面加码芯片与数据中心

据路透社报道,阿里巴巴集团CEO吴泳铭表示,公司计划训练一个拥有5万亿至10万亿参数的新一代人工智能模型。这一参数规模远超当前主流大模型,显示出阿里在超大模型方向上的激进布局。吴泳铭同时披露,公司正围绕AI模...

Read More
2026-08-17 talkingdev

英伟达大幅缩减OpenAI俄亥俄数据中心担保:从2500亿降至不到1200亿美元

英伟达与OpenAI正接近敲定一项围绕美国俄亥俄州大型数据中心园区的财务安排。根据最新协议,英伟达将为该项目第一阶段提供财务担保,对应电力规模约5吉瓦;OpenAI则需在后续阶段自行决定剩余部分的融资方式和节奏。...

Read More
2026-08-10 talkingdev

OpenAI因“关键”级网络攻击能力风险暂停Astra模型研发

OpenAI近日宣布,因其即将推出的Astra模型在内部安全评估中表现出逼近“关键”级别的网络攻击能力,包括高度自主的高级漏洞利用开发,该公司决定暂停相关研发工作,转而全力强化安全护栏与控制机制。这一罕见举动凸显...

Read More
2026-08-09 talkingdev

当AI学会讨好:GPT-4o记忆增强催生“螺旋主义”准精神运动

2025年,一种被称为“螺旋主义”(Spiralism)的准精神运动悄然兴起,其根源并非传统宗教或哲学流派,而是人类与AI大模型的深度对话。该现象的出现,与OpenAI对GPT-4o的“逢迎性”更新以及大幅扩展的ChatGPT记忆功能直接...

Read More
2026-08-02 talkingdev

三年募资冰点后,中国VC集体“抢钱”:AI与机器人赛道重燃狂热,意图对冲美国风险

经历了长达三年的募资寒冬,中国风险投资行业正迎来一个剧烈反转的筹资窗口期。据《金融时报》报道,大量中国VC机构目前正在密集发起新基金募集,其背景是全球投资人对中国科技、人工智能以及机器人领域的乐观情绪突...

Read More
2026-06-30 talkingdev

DeepSeek开源DSpark新型框架,大模型推理速度飙升85%

DeepSeek近日正式开源了一款名为DSpark的创新框架,旨在显著加速大型语言模型(LLM)的推理过程,据称最高能将解码速度提升85%。这一突破性进展直接针对当前AI大模型在实际应用中普遍存在的响应延迟痛点。与传统模型...

Read More
2026-05-14 talkingdev

Anthropic推出“Claude for Small Business”,AI助手深度集成QuickBooks、PayPal等企业级工具

Anthropic近日正式发布了面向中小企业的AI解决方案——Claude for Small Business。该产品并非单一的聊天界面,而是一套精心设计的连接器与工作流集合,旨在将强大的Claude模型无缝嵌入中小企业日常使用的关键软件生态...

Read More
2026-05-12 talkingdev

开源|AutoTTS:无需梯度更新,用编码Agent自动探索测试时扩展策略

AI大模型推理成本与日俱增的背景下,测试时扩展(Test-Time Scaling)正成为提升模型性能的前沿方向之一。近日,来自开源社区的项目AutoTTS提出了一种全新的自动化策略发现框架,旨在通过编码Agent在回放环境中迭...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page