Nvidia Nemotron 3开源权重模型,企业AI成本最高降20倍

PromptTree|阅读 0
2026/07/15 11:05
NvidiaNemotron开源模型企业AI
7月15日,Nvidia在Santa Clara发布Nemotron家族开源权重模型,称相较闭源方案推理成本最高可降20倍。Abridge、Harvey、LangChain、Arcee AI等已落地,并成立Nemotron Coalition。

闭源模型贵到企业开始算每一百万token时,Nvidia把一套可以拿走权重的模型放进了企业市场。

7月15日,Nvidia在Santa Clara发布Nemotron家族开源权重AI模型。核心卖点是:相比闭源方案,推理成本最高可降低20倍。发布逻辑建立在一个判断上:开源与闭源的性能差大约只有3.3%。差距收到个位数百分比之后,企业更在意能不能用得起、能不能自己改,而不是榜单再高零点几个点。3.3%是Nvidia用来论证的口径,不是一份独立评测的全部结论。

开源权重的意思是:企业可以检查和修改模型,所有权不锁在供应商接口后面。客户还能用自己的专有数据做微调,用在医疗、法律等高合规场景,而不必把专有数据送到第三方。微调,白话就是在已有模型上用自己的数据再训练一截,让它更懂本院病历或本所合同,而不是从零做一颗基座。

已经落地的例子把「便宜」拆成了不同行业:

  1. Abridge基于Nemotron定制临床对话基础模型
  2. Harvey在Nemotron 3 Ultra上做法律评测的后训练,精度对标顶级闭源模型,每次执行成本低10倍以上
  3. YTL AI Labs做了马来语适配
  4. LangChain在Nemotron 3 Ultra上的智能体精度达到开放模型领先水平,成本约为闭源替代品的十分之一
  5. Arcee AI在Blackwell平台后训练后,推理成本约0.9美元每百万输出token,约为可比闭源模型的二十分之一

配套上,Prime Intellect和Unsloth已启用企业级后训练流水线,NVIDIA NeMo开源库用来加速定制和评估。同期推出Nemotron Coalition,把模型构建者和开发者放进同一联盟,用共享数据、评估和领域经验继续改Nemotron。联盟不是开源许可本身,而是让改进有一个持续入口。

Nvidia的本业是卖GPU。把模型层开源,可以在芯片供应和出口规则收紧时,把推理工作负载继续留在Blackwell这类平台上。20倍是「最高」降幅,不是每个客户的账单。下一观察点是这些案例里的成本能否被第三方复算,以及联盟共享的数据会不会碰到各家最不愿拿出来的那一部分。