DiffusionGemma 发布:Google 用扩散模型把文本生成加速了 4 倍
Google 开源 DiffusionGemma:26B MoE(激活 3.8B)文本扩散模型,Apache 2.0 许可。H100 1000+ tokens/s,比传统模型快 4 倍。解读技术原理、性能数据和本地部署可行性。
Google 开源 DiffusionGemma:26B MoE(激活 3.8B)文本扩散模型,Apache 2.0 许可。H100 1000+ tokens/s,比传统模型快 4 倍。解读技术原理、性能数据和本地部署可行性。
Hugging Face 在 6 月 4 日发布博文,将官方 hf CLI 重构为同时面向人类和 AI 编程代理的命令行工具,关键数据:agent 自动识别、token 效率提升 2-6 倍、内置 skill 机制。
NVIDIA 发布 Nemotron 3 Ultra,550B MoE 开源模型,专为长程 Agent 工作流优化,Hermes Agent 官方支持。
MOSI.AI 和 OpenMOSS 团队发布 MOSS-TTS v1.5 + SoundEffect v2.0,覆盖语音合成、多人对话、音效生成、实时语音助手全套开源方案。Apache 2.0 协议,主观评测超豆包和 Gemini 2.5-pro。
Stanford 发布 OpenJarvis 1.0,一个本地优先的个人 AI 框架,内置 Ollama 支持。本文介绍上手方法和三个预设 agent。
起因:本地 AI 编程 Agent 终于能用了 2026年5月,OpenAI Codex CLI 全面免费,O … 阅读更多