AI
OpenAI 发布 GPT-5.6 Sol/Terra/Luna:三款模型、三种定位,安全优先的发布新节奏
OpenAI 正式发布 GPT-5.6 系列三款模型 Sol/Terra/Luna,从定价策略、性能分层、安全机制三个维度全面解析本次发布的差异化定位和行业影响。
Ollama 0.30 发布:GGUF 模型直接跑,Vulkan 默认开启,NVIDIA 性能再涨 20%
6 月初,Ollama 发布了 0.30 版本,正式接入了 llama.cpp 的 GGUF 生态——Hugging Face 的 GGUF 模型现在可以直接用 Modelfile 导入运行,NVIDIA GPU 性能提升最高 20%,Vulkan 渲染后端默认开启,AMD/Intel 显卡也能开箱即用。
MiniMax M3 发布:首个同时做到编码开源最强、百万上下文、原生多模态的开放权重模型
MiniMax 发布 M3——首个同时实现编码 Agents 前沿、1M 上下文、原生多模态的开放权重模型。本文解析 MSA 架构、跑分表现与真实任务演示。
Magenta RealTime 2:Google 把 AI 音乐做成了能跟弹的乐器
Google Magenta 团队 6 月 4 日发布的 Magenta RealTime 2,第一个把 AI 音乐做成”真能跟弹”的开源本地模型。控制延迟从 v1 的 3 秒降到 200ms,新增 MIDI 帧级控制,2.4B 参数的 base 版在 M3 Pro 以上的 MacBook 上就能实时跑。
Stable Audio 3.0 发布:Stability AI 开源了目前最强的本地音乐生成模型
Stability AI 发布 Stable Audio 3.0,Medium 模型开源权重,1.4B 参数可在 Mac 上生成 6 分钟器乐曲目。对比 Suno/Udio 的本地部署与版权优势。
ACE-Step v1.5:开源 AI 音乐生成追平 Suno,4GB 显存本地跑起来
ACE-Step v1.5 是 ACE Studio 和 StepFun 联合开发的开源音乐生成模型,多项指标追平 Suno v5,支持 50+ 语言、重绘、歌词编辑、人声转 BGM 等功能,最低 4GB 显存本地运行。
NVIDIA 开源 Nemotron 3.5 ASR:600M 参数的流式多语言语音识别,本地也能跑
NVIDIA 开源了 Nemotron 3.5 ASR Streaming,一个 600M 参数的流式多语言语音识别模型,支持 40 种语言实时转录,本地可跑。
Ollama v0.30 六月连发 7 版:MLX 性能暴涨、GGUF 模型通吃,本地 AI 工具箱又胖了一圈
如果你最近打开终端跑了 ollama update,可能没注意到——Ollama 在六月份一口气发了 7 个版 … 阅读更多