英伟达将推出两款全新的 AI 加速芯片

英伟达将推两款AI加速芯片:今年下半年发布Blackwell Ultra NVL72,浮点性能与内存容量均提升1.5倍,带宽翻倍并新增注意力指令;明年下半年推出Vera Rubin NVL144,集成自研CPU(性能翻倍、功耗仅50W)、CX9网卡、NVLink6与HBM4,实现全栈升级。

发布于2025年3月20日 04:19
编辑零重力瓦力
评论0
阅读63

英伟达即将推出两款面向数据中心的 AI 加速器芯片!

即将在今年下半年推出的 Blackwell Ultra NVL72,在多个关键指标上都实现了显著提升。浮点运算性能提高 1.5 倍,内存容量增加 1.5 倍,网络带宽翻倍,并引入了专门的注意力机制指令集,这些升级都将显著提升大型语言模型的训练和推理效率。

计划于明年下半年推出的 Vera Rubin NVL144,是以发现暗物质的著名天文学家 Vera Rubin 命名,并且是一次全方位的技术革新。它采用了全新设计的 CPU,性能较现有的 Grace 处理器提升一倍,而功耗仅有 50 瓦。产品整合了新一代 CX9 网络智能网卡、NVLink6 互联技术和 HBM4 内存,几乎每个核心组件都经过重新设计。

或许,随着基础设施升级、模型增强、应用拓展能够形成一个令人期待的良性循环。但是,我们也需要留意,随着技术复杂度提升,行业门槛也在不断抬高,AI 能力可能会进一步集中在少数具备强大研发实力和资本优势的企业手中。

相关文章

本地跑赢千亿旗舰的 Qwen 3.8 27B,如何用参数驯服过度思考
AI 新闻资讯
2026年8月20日
0 条评论
小创

本地跑赢千亿旗舰的 Qwen 3.8 27B,如何用参数驯服过度思考

Qwen 3.8 27B以17GB显存实现媲美千亿旗舰的性能,但默认深思机制易引发过度思考。掌握推理强度(low/medium/xhigh)等调参逻辑,能助开发者在本地兼顾极速响应与复杂任务高准确率。

#AI编程#本地模型#Qwen
阅读全文
Qwen 3.8 27B 调节推理深度并用 MTP 提速 72% 的避坑指南
AI 新闻资讯
2026年8月19日
0 条评论
小创

Qwen 3.8 27B 调节推理深度并用 MTP 提速 72% 的避坑指南

Qwen 3.8 27B 默认 xhigh 推理档位易致算力浪费,简单任务建议调低 reasoning_effort 或关闭推理以提升响应速度;复杂多步任务则需保留高推理以确保准确性。配合 MTP 多 token 预测技术,本地推理速度可提升 72%。该模型底层能力优秀,用户应根据场景灵活调节推理深度以平衡效率与质量。此外,行业亟需统一推理能效标准,解决不同厂商默认策略不透明导致的成本黑盒问题。

#本地AI#Qwen#推理控制
阅读全文
字节即梦 Seedance 2.5 提示词工程,用分镜级契约攻克 AI 视频失控难题
AI 新闻资讯
2026年8月19日
0 条评论
小创

字节即梦 Seedance 2.5 提示词工程,用分镜级契约攻克 AI 视频失控难题

针对字节即梦 Seedance 2.5 模型,开源项目 Seedance-ShotDesign-Skills 通过“提示词契约”将 AI 视频生成从玄学升级为工程化流程。该技能库对齐最新官方硬限制,提供复杂视频、延长及关键帧优先等结构化模板,结合焦段心理学与中文运镜词典规避审核风险。其内置 14 种工作流路由及本地校验器,确保提示词合规。该工程旨在降低创意落差、解决叙事与镜头一致性问题,而非提升原生画质。

#AI视频#提示词工程#即梦
阅读全文
互动讨论

评论区

围绕《英伟达将推出两款全新的 AI 加速芯片》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。