英伟达推出Nemotron 3.5 Lightning开放模型,支持在RTX PC等设备本地运行
AI 摘要
一句话摘要: 英伟达推出Nemotron 3.5 Lightning开放模型,支持RTX PC等本地运行,并开发万亿参数Nemotron 4。 关键事实: Nemotron 3.5 Lightning可在RTX PC、DGX Spark等设备本地运行,已与vLLM、Ollama等工具集成,Nemo Switchyard将基准测试成本降至Opus 4.8的三分之一,Nemotron 4最大版本预计超1万亿参数。 涉及主体: 英伟达, vLLM, Ollama, llama.cpp, LM Studio, Unsloth, The Information 可能影响: 推动AI模型本地化部署,降低企业推理成本,加剧开源模型与闭源模型的性能竞争,同时为边缘AI硬件生态带来增量需求。 是否值得继续跟踪: 是,Nemotron 4的万亿参数规模可能重塑开源模型格局,且本地运行策略与Crypto去中心化算力叙事存在潜在交集。 噪音/炒作风险: 中,英伟达硬件生态绑定明显,但模型实际性能与成本优势需第三方验证,且“万亿参数”尚未发布,存在预期炒作成分。