AI热点 3小时前 161 阅读 0 评论

英特尔打造高效异构 AI 系统:结合自家 Gaudi3 AI 加速器与英伟达 B200 GPU

作者头像
AI中国

AI技术专栏作家 | 发布了 246 篇文章

IT之家 10 月 20 日消息,英特尔在 2025 OCP 全球峰会上展示了其打造的一款高效异构 AI 系统,这一混合计算基础设施结合了英特尔自家的 Gaudi3 AI 加速器与英伟达的 B200 Tensor Core GPU。

具体而言,在该平台上 B200 负责 AI 模型的预填充而解码部分则由 Gaudi3 负责,相较仅 B200 的同构解决方案在 Llama 开源模型上实现了至高 70% 的同 TCO 性能增益

根据外媒 SemiAnalysis 的补充,这一混合机架系统采用了英伟达的 ConnectX-7 400GbE NIC、BlueField-3 DPU 和博通的 Tomahawk 5 51.2Tb/s 交换芯片,实现了更大的扩展域。

▲ 图源:SemiAnalysis

相关阅读:

  • 《首款专为大规模上下文 AI 设计的 CUDA GPU,英伟达 Rubin CPX 发布》

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

作者头像

AI前线

专注人工智能前沿技术报道,深入解析AI发展趋势与应用场景

246篇文章 1.2M阅读 56.3k粉丝

评论 (128)

用户头像

AI爱好者

2小时前

这个更新太令人期待了!视频分析功能将极大扩展AI的应用场景,特别是在教育和内容创作领域。

用户头像

开发者小明

昨天

有没有人测试过新的API响应速度?我们正在开发一个实时视频分析应用,非常关注性能表现。

作者头像

AI前线 作者

12小时前

我们测试的平均响应时间在300ms左右,比上一代快了很多,适合实时应用场景。

用户头像

科技观察家

3天前

GPT-4的视频处理能力已经接近专业级水平,这可能会对内容审核、视频编辑等行业产生颠覆性影响。期待看到更多创新应用!