字节跳动近日在GitHub上开源了一款名为Lance的原生统一多模态模型,以其仅3B(30亿)激活参数的设计,在AI领域引起了广泛关注。该模型打破了传统多模态模型需要为不同任务(如图像理解、视频生成、图像编辑等)分别...
Read More英伟达(NVIDIA)最新开源了LongLive 1.0框架,旨在解决长视频生成领域长期面临的实时交互难题。该框架通过引入流式注意力(Streaming Attention)和KV缓存优化(KV-cache optimization)技术,实现了对超长视频序列...
Read More一项最新研究揭示了语言模型在预训练过程中的一个惊人现象:它们并非平稳地提升能力,而是在“模仿”和“智能行为”之间突然切换,研究人员将其称为“模式跳跃”。这种非连续性的行为转变无法通过标准的优化技术(如调整学...
Read More近日,一款名为HRM-Text的新型文本生成模型在GitHub上开源,引发了AI社区的广泛关注。该模型基于HRM架构,参数规模为10亿(1B),但其最大的亮点在于惊人的训练效率。据项目介绍,HRM-Text的训练所需的计算资源和数...
Read MoreSemble是一款由MinishLab开发的高性能代码搜索库,专为帮助AI智能体通过自然语言快速定位代码片段而设计。它的核心亮点在于大幅降低Token消耗——相比传统的‘grep+read’方法,Semble能减少约98%的Token使用量,同时保...
Read More在AI辅助编程工具日益臃肿的当下,Zerostack以“极简主义”和极致的性能优化脱颖而出。该项目完全采用Rust编写,核心设计目标是在保持极低内存占用的同时,提供强大的编码代理能力。Zerostack不仅支持多种主流AI提供商...
Read More近日,一位开发者成功将售价仅80美元的RK3562芯片Android平板电脑改造为运行Debian Linux操作系统的开源工作平台,该项目在GitHub上引起了广泛关注。RK3562是一款基于ARM架构的低功耗处理器,通常用于成本敏感的移动...
Read More在大型代码库中,AI编程助手(如Claude Code)进行代码搜索时,常常面临效率瓶颈:当直接查找失败,它们会退回到grep等传统工具或读取整个文件,这往往导致大量的Token消耗,且检索质量不佳。针对这一痛点,开发者St...
Read More