NVIDIA Nemotron:英伟达开源智能体模型家族,Nano/Super/Ultra 覆盖语言多模态与语音

NVIDIA Nemotron

官方背景

NVIDIA Nemotron 是英伟达面向”智能体式 AI(Agentic AI)”打造的开源基础模型家族,2026 年持续扩展:Nemotron 3 系列涵盖 Nano(30B-A3B)、Super(120B-A12B)、Ultra(550B-A55B)等语言模型,以及 Omni(视听语言统一理解)、VoiceChat(实时语音对话)、语音(ASR / TTS / NMT)、Parse(文档智能)、RAG(检索)、Safety(安全审核)等子模型。模型权重、训练数据与技法均在 Hugging Face 开源(NVIDIA Open Model License,可商用、免署名)。

核心能力

混合 MoE 架构带来最高吞吐,专为长时运行智能体优化;② 1M token 长上下文,擅长编码、推理、指令遵循与工具调用;③ 多模态 Nemotron(Nano 12B v2 VL 多图视频理解;Nano Omni 30B 理解图 / 视频 / 语音 / 文本);④ Nemotron 语音高吞吐超低延迟 ASR / TTS / S2S / NMT;⑤ Nemotron Parse 突破传统 OCR,支持多栏 / LaTeX / 表格 / 阅读顺序重建;⑥ 以 NVIDIA NIM 微服务形式安全部署,并由 Dynamo / TensorRT-LLM / SGLang / vLLM 规模化。

应用场景

编程助手与复杂工作流自动化(Coding Assistant、Search);计算机使用智能体(CUA)与文档智能(RAG 数据精选、企业文档管线);视频 / 音频理解子智能体;实时语音对话助手;企业多智能体系统(客户服务、供应链、IT 安全)。已被 Cursor、ServiceNow、Perplexity、CrowdStrike、Factory 等采用;医疗(Novo Nordisk)、机器人(Isaac GR00T)、自动驾驶(Alpamayo)亦在用 NVIDIA 开放模型。

定价与可及性

模型权重在 Hugging Face 完全免费下载、可免费用于生产;NVIDIA NIM 微服务形式需 NVIDIA AI Enterprise 许可(可先免费试用 build.nvidia.com 上的多个免费端点,如 nemotron-3-nano-30b-a3b、nemotron-3-super-120b-a12b、nemotron-3-ultra-550b-a55b)。开发者可用 vLLM / SGLang / TensorRT-LLM / llama.cpp 自托管。NVIDIA 承诺持续发布更多模型、数据集与技法。

立即体验 NVIDIA Nemotron →

NVIDIA Nemotron · NVIDIA Nemotron 是英伟达面向”智能体式 AI(Ag…

© 版权声明
THE END
喜欢就支持一下吧
点赞106 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容