AI人物 2周前 207 阅读 0 评论

AI已迷失方向?强化学习教父Sutton最新发布OaK架构,挑战当前AI范式,提出超级智能新构想

作者头像
AI中国

AI技术专栏作家 | 发布了 246 篇文章

作者 | 理查德·萨顿(Richard Sutton)

原标题 | OaK 架构:一个源于经验的超级智能构想

来源 | RLC 2025 会议文章(youtu.be/gEbbGyNkR2U)

编译 | 王启隆

出品丨AI 科技大本营(ID:rgznai100)

随着人工智能发展成为一个庞大的产业,它在很大程度上已经迷失了方向。

我们需要什么才能重回正轨,去探寻真正的智能?

我们需要能够持续学习的智能体、世界模型和规划能力,以及学习高层次知识和通过元学习掌握泛化的能力。

OaK 架构正是对所有这些需求的一个系统性回应。从整体上看,它是一个基于模型的强化学习架构,并具备三个鲜明特点:

1)其所有组件都能持续学习;

2)每一个学习到的权重,都配有一个专门的步长参数,该参数通过在线交叉验证进行元学习;

3)状态和时间上的抽象概念,通过一个我们称之为 FC-STOMP 的五步演进路径被持续创造出来,即:特征构建(

OaK 架构的内容相当丰富。在本文中,我们将勾勒其轮廓,并阐明那些为这一宏大构想——即超级智能如何从智能体的经验中涌现——做出贡献的诸多既有和同期的研究工作。

【活动分享】2025 全球机器学习技术大会(ML-Summit)北京站将于 2025 年 10 月 16-17 日在北京威斯汀酒店举办。大会共 12 大主题、50+ 海内外专家,聚焦大模型技术和应用变革。详情参考官网:https://ml-summit.org (或点击原文链接)。

作者头像

AI前线

专注人工智能前沿技术报道,深入解析AI发展趋势与应用场景

246篇文章 1.2M阅读 56.3k粉丝

评论 (128)

用户头像

AI爱好者

2小时前

这个更新太令人期待了!视频分析功能将极大扩展AI的应用场景,特别是在教育和内容创作领域。

用户头像

开发者小明

昨天

有没有人测试过新的API响应速度?我们正在开发一个实时视频分析应用,非常关注性能表现。

作者头像

AI前线 作者

12小时前

我们测试的平均响应时间在300ms左右,比上一代快了很多,适合实时应用场景。

用户头像

科技观察家

3天前

GPT-4的视频处理能力已经接近专业级水平,这可能会对内容审核、视频编辑等行业产生颠覆性影响。期待看到更多创新应用!