英伟达GPU加速的多款开放模型相继发布
IT时代网8月12日消息,近期一批面向英伟达 GPU 优化的开放模型与工具集中亮相,覆盖机器人、视觉生成、智能体编程与本地推理等多个方向。
英伟达发布的 Cosmos 3 Edge 是一款 40 亿参数的开放世界模型,面向机器人、智能汽车与视觉 AI,规模仅为 Cosmos 3 Nano 的四分之一,可在 DGX Spark 与 Jetson 设备端运行。MiniMax-H3 则是 330 亿参数的开放权重模型,能由文本、图像、视频或音频生成视频与原生同步立体声,创作者可通过 ComfyUI 调用,并借助针对英伟达 GPU 优化的 checkpoints 在本地运行。
智能体编程方面,Poolside AI 推出 1180 亿参数的 Laguna S 2.1,可处理持续数小时的长时任务,借助 NVFP4 checkpoint 在单台 DGX Spark 上本地运行而不牺牲准确性。DeepSeek 近期更新的 V4-Flash 为 2840 亿参数混合专家模型,激活参数 130 亿、上下文窗口 100 万 token。
多模态方向,Thinking Machines Lab 的 Inkling-Small 具备跨文本、图像与音频的原生推理能力并支持可调节推理强度,可在两台 DGX Spark 上运行,面向 Blackwell 优化的 NVFP4 checkpoint 已上线 Hugging Face。Unsloth 将于本周推出完全开源的 Unsloth Desktop,把本地推理、图像视频生成、微调、智能体与代码执行整合进一款桌面应用,号称首款可在本地训练并运行 AI 模型的桌面应用。
阿里巴巴发布的 Wan-Animate-2 为 140 亿参数开放权重模型,可将驱动视频中的动作与表情迁移到静态角色图像,覆盖真人、卡通、机器人与动物;借助 ComfyUI 首日支持,该模型在 RTX PRO 5000 Blackwell(48GB)上的生成速度最高可达 Apple M3 Ultra 的 16 倍。

注:本文中包含AI辅助创作的内容。