NVIDIA 与本地 AI 社区推动开源模型与智能代理
摘要
NVIDIA 博客宣布开启本地 AI 月,汇总了来自多家机构的多款开源模型、工具和硬件加速更新,涵盖视觉、视频、编码与智能代理。
核心要点
- NVIDIA 发布 Cosmos 3 Edge,4B 参数开放世界模型,规模为 Cosmos 3 Nano 四分之一,可在 DGX Spark 和 Jetson 上运行。
- MiniMax-H3 为 33B 参数开放权重模型,支持从文本/图像/视频/音频生成视频及同步立体声,可通过 ComfyUI 使用。
- Poolside 推出 Laguna S 2.1,118B 参数 agentic coding 模型,NVFP4 检查点允许在单块 DGX Spark 上本地运行。
- DeepSeek 发布 DeepSeek-V4-Flash,284B 参数 MoE 模型(13B 活跃参数),100 万 token 上下文,可本地运行于 DGX Station。
- Thinking Machines Lab 发布 Inkling-Small,276B 参数多模态推理模型,每 token 激活 12B 参数,可在单台 DGX Station 或两台 DGX Spark 上运行。
原文佐证
- At a quarter the size of Cosmos 3 Nano, it runs on device on NVIDIA DGX Spark and NVIDIA Jetson.
- It’s the first desktop app to train and run AI models locally.
AI 洞察
此次集中发布显示本地 AI 正从单一模型走向全家桶:更强的端侧推理、开源权重与消费级硬件结合,使智能代理的日常化成为可能。未来开发者可在本地完成训练、微调和推理,数据隐私和算力成本的瓶颈将显著降低。这场竞争将重塑从芯片(GPU)到应用生态的整个价值链。