漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-09-04 talkingdev

Three-LLM 实现浏览器本地运行大模型:基于 WebGPU 与 Three.js 将解码速度提升至 566 tokens/s

Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...

Read More
2026-09-04 talkingdev

Gimlet Labs获a16z领投3亿美元、估值30亿,异构AI芯片任务分配成资本新宠

彭博社消息,Gimlet Labs完成由a16z领投的3亿美元新一轮融资,投后估值达到30亿美元。值得注意的是,该公司六个月前刚完成8000万美元A轮融资,估值与融资额均快速跳升。Gimlet Labs的核心方向是将AI计算任务拆分并调...

Read More
2026-09-03 talkingdev

Cline 最大规模重构揭秘:7.6 万行核心换成共享 SDK,1100 万开发者平滑迁移,智能体失败率降 10 倍

Cline 团队近日公布了其 VS Code 扩展迄今最大规模重构的实践细节。该扩展将约 7.6 万行的单体代理核心替换为共享 SDK,并在不影响 1100 多万开发者既有工作流的前提下完成切换。由于 VS Code Marketplace 缺乏渐进...

Read More
2026-09-01 talkingdev

Neon 推出 Lakebase Postgres 实时自动扩缩容:数据库资源按 CPU、内存动态伸缩且不中断业务

Neon 官方博客披露其基于 Lakebase Postgres 实现的数据库实时自动扩缩容机制。该方案将存储与计算解耦,使计算规模可以根据 CPU 负载、内存使用以及缓存工作集大小实时调整,而无需中断在线操作。相比传统数据库扩...

Read More
2026-09-01 talkingdev

OpenClaw 2.0 意外诞生:从简化安装演变为史上最大规模重构

OpenClaw 项目近日发布迄今为止最大规模版本更新 OpenClaw 2.0。此次升级最初目标是简化安装流程并重构浏览器端体验,但在工程推进中需求范围持续扩大,最终演变为覆盖记忆、技能、模型、自动化、应用、插件、安全等...

Read More
2026-08-31 talkingdev

领域驱动代理(Domain-Driven Agents)如何破解LLM在遗留系统中的落地难题

在软件工程中引入大语言模型(LLM)已在绿地项目中展现出显著的生产力提升,但在遗留系统场景下,模型常受困于长期累积的技术债务与术语不一致问题。文章指出,单纯依赖模型能力难以应对复杂的历史架构,需要引入清...

Read More
2026-08-31 talkingdev

NVIDIA发布DeepSeek-V4-Pro-0813-NVFP4量化模型:MoE架构助力智能体与企业级AI

NVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...

Read More
2026-08-31 talkingdev

英伟达AI优势正超越GPU:Vera Rubin架构重塑超大规模数据中心效率

英伟达正在将AI竞争优势从单一GPU扩展到整个数据中心系统层面。在最新的Vera Rubin架构中,除GPU外,英伟达引入Vera CPU等专用组件,重点提升数据编排与调度效率。这意味着其战略正从单纯追求更强处理器算力,转向优...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page