漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-23 talkingdev

OpenAI 将基础设施计划规模提升至 7500 亿美元,首座 3.2 吉瓦超算园区浮出水面

OpenAI 的 AI 基础设施投入计划再次大幅加码。据报道,该公司已将截至 2030 年的基础设施总支出目标上调至 7500 亿美元,几乎相当于整个瑞典的国内生产总值。这一惊人数字背后,是 AI 模型训练和推理对算力需求近乎...

Read More
2026-07-23 talkingdev

美国能源部联手Arcee AI推出开放权重模型Genesis-Science-1,助力科学计算可复现

美国能源部与开放智能实验室Arcee AI宣布联合开发Genesis-Science-1(GS1),一个面向科学计算工作流的开放权重AI模型。该项目旨在解决科学研究中计算流程难以复现的长期痛点,通过透明、可定制的模型架构和开放权重...

Read More
2026-07-22 talkingdev

开源|Openship:一站式自托管部署平台,重塑基础设施管理体验

Openship 是一款近期在开发者社区引发关注的开源自托管部署平台,其核心理念在于通过统一的操作界面,大幅简化从代码推送、容器交付到多服务运维的完整链路。该平台具备广泛的编程语言与开发栈兼容性,并内建了持续...

Read More
2026-07-22 talkingdev

Agent Client Protocol v2 草案发布:重构代码编辑器与智能代理的通信范式

Agent Client Protocol(ACP)旨在标准化代码编辑器与编码代理(Coding Agents)之间的通信方式,定义了双方可互相调用的方法及事件通知机制。近日,ACP v2 草案正式对外公开,正邀请社区进行审查和测试。新版本在过...

Read More
2026-07-21 talkingdev

谷歌秘密研发新一代AI芯片Frozen v2,或将大幅降低Gemini推理成本

据TechCrunch报道,谷歌母公司Alphabet正在秘密推进一项代号为Frozen v2的服务器芯片项目,目标是在2028年前后实现部署。这款芯片专为提升Gemini系列大模型的运行效率而设计,其核心突破在于能效比:与谷歌现有的AI...

Read More
2026-07-21 talkingdev

AMD发布首款机架级AI系统Helios挑战英伟达,微软火速成为最新客户

AMD正式发布了其首款机架级人工智能系统Helios,直接对标英伟达的同类产品,标志着AI基础设施竞赛进入全新阶段。该系统将数据中心级的算力、高速互连与能效优化深度整合在单一机架内,能够为千亿乃至万亿参数大模型...

Read More
2026-07-20 talkingdev

开源|大模型之战,是数据库战争的重演吗?

该观点将当前的大语言模型竞争与上世纪90年代的数据库之争进行了历史性类比,揭示了技术基础设施演进的一种深层规律。作者认为,大语言模型正沿着数据库的发展轨迹前进:从最初作为引发行业狂热的前沿技术,逐步演化...

Read More
2026-07-20 talkingdev

Netflix 自研内部 LLM 推理平台:基于 vLLM 与 Triton 的统一服务架构,实现高效模型部署与 A/B 测试

Netflix 近期公开了其内部自研的大语言模型(LLM)推理服务平台的设计与实践。与依赖外部托管 API 不同,该平台将模型部署和推理完全集成到 Netflix 现有的生产环境中,既保障了数据安全与低延迟,又实现了对模型的...

Read More
  1. Prev Page
  2. 10
  3. 11
  4. 12
  5. Next Page