AI 模型

NVIDIA 开源 Cosmos 3 Edge:4B 参数的世界模型,跑在边缘设备上

NVIDIA 开源了一个 4B 参数的世界模型 Cosmos 3 Edge,专门为 Jetson 等边缘设备设计。它用双 Transformer 架构同时做实时推理和动作生成,在机器人控制分辨率下跑到了 15Hz。对搞物理 AI 应用的人来说,这意味着不用再为模型太大发愁了。

阅读详情NVIDIA 开源 Cosmos 3 Edge:4B 参数的世界模型,跑在边缘设备上

NVIDIA 与 Hugging Face 联手:大规模微调图像与视频扩散模型

NVIDIA 和 Hugging Face 联手,让你微调 FLUX、Wan 这类模型时不用再重写分布式训练代码。NeMo Automodel 把 FSDP2、Tensor Parallel 等并行策略变成了配置文件里的几个开关,从8张卡到数百张卡,脚本一行不改。8卡 H100 上跑 FLUX 全参数微调,每步不到1秒。

阅读详情NVIDIA 与 Hugging Face 联手:大规模微调图像与视频扩散模型

新模型,老优势

多语言大模型做OCR看起来很强大,但在巴西葡萄牙语这类细分语言上,一个专注的专用模型能轻松碾压更新、更重的通用模型。这篇博客用真实数据和具体失败案例告诉你:资源聚焦比规模更重要,而且这个逻辑不会因为模型进步而改变。

阅读详情新模型,老优势