Three-LLM 项目展示了一种全新的浏览器端大模型推理路径:它将 GPT-2、SmolLM2、Qwen 和 Phi 等模型的推理图,直接翻译为 Three.js TSL 计算着色器,并借助 WebGPU 在本地完成计算。与常见方案不同,它不需要服务端...
Read More彭博社消息,Gimlet Labs完成由a16z领投的3亿美元新一轮融资,投后估值达到30亿美元。值得注意的是,该公司六个月前刚完成8000万美元A轮融资,估值与融资额均快速跳升。Gimlet Labs的核心方向是将AI计算任务拆分并调...
Read MoreCline 团队近日公布了其 VS Code 扩展迄今最大规模重构的实践细节。该扩展将约 7.6 万行的单体代理核心替换为共享 SDK,并在不影响 1100 多万开发者既有工作流的前提下完成切换。由于 VS Code Marketplace 缺乏渐进...
Read MoreNeon 官方博客披露其基于 Lakebase Postgres 实现的数据库实时自动扩缩容机制。该方案将存储与计算解耦,使计算规模可以根据 CPU 负载、内存使用以及缓存工作集大小实时调整,而无需中断在线操作。相比传统数据库扩...
Read MoreOpenClaw 项目近日发布迄今为止最大规模版本更新 OpenClaw 2.0。此次升级最初目标是简化安装流程并重构浏览器端体验,但在工程推进中需求范围持续扩大,最终演变为覆盖记忆、技能、模型、自动化、应用、插件、安全等...
Read More在软件工程中引入大语言模型(LLM)已在绿地项目中展现出显著的生产力提升,但在遗留系统场景下,模型常受困于长期累积的技术债务与术语不一致问题。文章指出,单纯依赖模型能力难以应对复杂的历史架构,需要引入清...
Read MoreNVIDIA在Hugging Face平台推出DeepSeek-V4-Pro-0813-NVFP4量化模型,该模型是DeepSeek-V4-Pro-0813的量化版本,采用自回归混合专家(MoE)语言模型架构。通过NVIDIA Model Optimizer量化后,模型在保持高级推理能力...
Read More英伟达正在将AI竞争优势从单一GPU扩展到整个数据中心系统层面。在最新的Vera Rubin架构中,除GPU外,英伟达引入Vera CPU等专用组件,重点提升数据编排与调度效率。这意味着其战略正从单纯追求更强处理器算力,转向优...
Read More