漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-06-08 talkingdev

开源|Mitos:一键将图片和GIF转ASCII艺术的生成器,支持实时预览与自定义字符集

Mitos 是一个基于 ASCII 艺术生成技术的开源工具,旨在将图像、GIF 动画甚至自定义 JavaScript 代码转化为纯文本风格的视觉作品。该项目由 Oxide Computer Company 开发,托管于 GitHub,具备较高的科技可玩性和实用...

Read More
2026-05-21 talkingdev

开源|字节跳动Lance:3B参数原生统一多模态模型,图像视频理解与生成编辑全搞定

字节跳动近日在GitHub上开源了一款名为Lance的原生统一多模态模型,以其仅3B(30亿)激活参数的设计,在AI领域引起了广泛关注。该模型打破了传统多模态模型需要为不同任务(如图像理解、视频生成、图像编辑等)分别...

Read More
2026-02-25 talkingdev

开源|Moonshine开源语音识别模型:边缘设备上的STT精度超越WhisperLargev3

一家名为Moonshine AI的小型初创公司(团队仅六人,月GPU预算低于10万美元)近日在GitHub上开源了其自动语音识别(ASR)项目Moonshine。该项目针对边缘设备优化,提供了快速且高精度的语音转文本(STT)模型。据开发...

Read More
2026-02-17 talkingdev

开源|FreeFlow:对标Wispr Flow与Superwhisper的开源实时语音转写替代方案

近日,开发者Zach Latta在GitHub上发布了名为FreeFlow的开源项目,旨在为市场上流行的实时语音转写服务(如Wispr Flow、Superwhisper、Monologue等)提供一个免费且开源的替代方案。该项目在Hacker News社区引发了广...

Read More
2026-02-08 talkingdev

X平台API定价模式重大变革:推出按量计费,取代每月200或5000美元固定费用

社交媒体平台X(原Twitter)近日对其开发者应用编程接口(API)的定价策略进行了根本性调整,正式推出全新的按使用量付费(pay-per-use)模式,取代了此前备受争议的固定月费制度。这一变革标志着X在平台商业化与开...

Read More
2025-12-18 talkingdev

开源|Chatterbox:支持情感控制与零样本语音克隆的SOTA开源TTS模型发布

近日,由Resemble AI团队在GitHub上开源了名为Chatterbox的文本转语音模型,标志着开源TTS领域迈入了一个新的技术高度。该项目被定位为当前最先进的开源TTS解决方案,其核心亮点在于集成了多语言支持、精细化的情感...

Read More
2025-11-01 talkingdev

探索混沌之美:开发者用Three.js打造奇异吸引粒子系统

开发者Shashank Tomar近日发布了一个基于Three.js构建的奇异吸引粒子系统可视化项目。该项目通过动态粒子系统生动呈现了混沌理论中的奇异吸引现象,让用户能够直观观察非线性动力系统中看似随机却蕴含规律的运动轨迹...

Read More
2025-09-29 talkingdev

影子AI威胁企业安全:46%员工无意中泄露敏感数据

随着生成式AI工具的普及,企业正面临新型安全威胁——影子AI。最新研究显示,高达46%的员工在使用未经授权的公共AI工具时,可能将客户信用卡信息、知识产权等敏感数据暴露于风险中。这种现象源于员工为提高工作效率而...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page