AI热点 5月前 • 86 阅读 • 0 评论

国际象棋最强 AI 鸣锣开赛：首日战果公布，OpenAI 的 o3、xAI 的 Grok4 等晋级

作者头像

AI中国

AI技术专栏作家 | 发布了 246 篇文章

感谢IT之家网友那些繁华往事的线索投递！

IT之家 8 月 6 日消息，科技媒体 webpronews 昨日（8 月 5 日）发布博文，报道称谷歌 DeepMind 于 8 月 5~7 日在 Kaggle 的 Game Arena 平台上，举办“AI 国际象棋”比赛，邀请 OpenAI、Anthropic、谷歌、Kimi、Deepseek 在内的顶尖模型一较高下。

DeepMind 表示，本次“AI 国际象棋”比赛的目的，是检验顶级 AI 模型的推理能力。本次活动将于 8 月 5~7 日举行，每日举办一轮比赛，由国际象棋大师 Hikaru Nakamura 和流媒体播主 Levy Rozman 解说。

在 AI 发展的重要时刻，这场象棋对决提供了一个严格的测试，以评估 AI 的预见和策略调整能力，文本基础的格式解决了许多大型语言模型在视觉象棋盘表示上的难题，提供了一个更公平的推理能力测试。

IT之家附上本次参赛选手如下：

Gemini 2.5 Pro（Google）
Gemini 2.5 Flash（Google）
o3（OpenAI）
o4-mini（OpenAI）
Claude 4 Opus（Anthropic）
Grok 4（xAI）
DeepSeek R1
Kimi k2（Moonshot AI）

根据首日战况，OpenAI 的 o4 mini 胜过 Deepseek-R1、OpenAI 的 o3 超过 Kimi K2 Instruct 模型、谷歌的 Gemini 2.5 Pro 胜过 Claude Opus 4、xAI 的 Grok4 模型超过谷歌的 Gemini 2.5 Flash。

广告声明：文内含有的对外跳转链接（包括不限于超链接、二维码、口令等形式），用于传递更多信息，节省甄选时间，结果仅供参考，IT之家所有文章均包含本声明。

作者头像

AI前线

专注人工智能前沿技术报道，深入解析AI发展趋势与应用场景

246篇文章 1.2M阅读 56.3k粉丝

评论 (128)

用户头像

AI爱好者

2小时前

这个更新太令人期待了！视频分析功能将极大扩展AI的应用场景，特别是在教育和内容创作领域。

用户头像

开发者小明

昨天

有没有人测试过新的API响应速度？我们正在开发一个实时视频分析应用，非常关注性能表现。

作者头像

AI前线作者

12小时前

我们测试的平均响应时间在300ms左右，比上一代快了很多，适合实时应用场景。

用户头像

科技观察家

3天前

GPT-4的视频处理能力已经接近专业级水平，这可能会对内容审核、视频编辑等行业产生颠覆性影响。期待看到更多创新应用！

文章章节

1. GPT-4简介与注册指南

1.1 账号注册步骤

推荐文章

何必DiT！字节首次拿着自回归，单GPU一分钟生成5秒720p视频

何必DiT！字节首次拿着自回归，单GPU一分钟生成5秒720p视频

2月前 • AI热点

用户破8亿！GPT-5.1来了，表情包含量可自定义

用户破8亿！GPT-5.1来了，表情包含量可自定义

2月前 • AI热点

速抢（2核2G）77元/年香港免备案服务器

速抢（2核2G）77元/年香港免备案服务器

0秒前 • AI热点

李飞飞的世界模型来了！一句话生成3D世界，AI 真的开始理解现实了

李飞飞的世界模型来了！一句话生成3D世界，AI 真的开始理解现实了

2月前 • AI热点

科技巨头「偷偷借钱」搞AI，次贷危机魅影重现？

科技巨头「偷偷借钱」搞AI，次贷危机魅影重现？

2月前 • AI热点

腾讯总裁剧透微信搭载智能体！阿里和谷歌也都开始互相伤害了

腾讯总裁剧透微信搭载智能体！阿里和谷歌也都开始互相伤害了

2月前 • AI热点

AIGC大模型能力提升10倍！安谋科技Arm China掏出最强NPU IP大招

AIGC大模型能力提升10倍！安谋科技Arm China掏出最强NPU IP大招

2月前 • AI热点

小鹏物理AI的尽头，是马斯克的现金流

小鹏物理AI的尽头，是马斯克的现金流

2月前 • AI热点

热门标签

影视级音画同步模型系外行星印孚瑟斯专业AI AI试衣应用 chatGPT4-o AI高考作文数字营销工具语音助手 AI产业发展

热门作者

作者头像

AI前沿

2.4k 粉丝

作者头像

机器学习实验室

1.8k 粉丝

作者头像

AI创业圈

3.1k 粉丝