AI热点 3月前 240 阅读 0 评论

字节跳动发布豆包 1.5 深度思考模型,具备“看图思考”能力

作者头像

AI技术专栏作家 | 发布了 246 篇文章

IT之家 4 月 17 日消息,在今日火山引擎 AI 创新巡展杭州站现场,字节跳动旗下火山引擎总裁谭待发布了最新的豆包 1.5・深度思考模型。

据介绍,该模型在数学、编程、科学推理等专业领域及创意写作等通用任务中表现突出。数学推理 AIME 2024 测试得分追平 OpenAI o3-mini-high,编程竞赛和科学推理测试成绩也接近 o1。在创意写作、人文知识问答等通用任务上,模型也展示出优秀的泛化能力,能胜任更广泛的使用场景。

技术报告显示,该模型采用 MoE 架构,总参数 200B,激活参数为 20B,低于业界同类模型参数规模的 50%,具备显著的推理成本优势。豆包模型 API 服务在保障高并发的同时,延迟低至 20 毫秒。

谭待在会上详细介绍了豆包 1.5 深度思考模型的强大功能。该模型能够结合视觉理解技术提供更多功能,例如根据照片分析地貌,或在旅行时辅助点餐、完成企业项目管理流程图。

此外,豆包文生图模型 Seedream3.0 也正式向企业开放。该模型已在即梦 AI、豆包产品上线,并在近期登上权威竞技场 Artificial Analysis 文生图榜单第一梯队。Seedream3.0 支持 2K 分辨率直出,生图结构准确性、小字生成与排版、美感、真实度等方面具有优势。

值得关注的是,新模型的视频搜索能力也更强,模型能够根据用户搜索问题在视频中寻找相应答案。

同时IT之家注意到,谭待表示,豆包大模型使用量持续高速增长。截至 2025 年 3 月,豆包大模型日均 tokens 使用量超 12.7 万亿,较发布之初增长超 106 倍。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

作者头像

AI前线

专注人工智能前沿技术报道,深入解析AI发展趋势与应用场景

246篇文章 1.2M阅读 56.3k粉丝

评论 (128)

用户头像

AI爱好者

2小时前

这个更新太令人期待了!视频分析功能将极大扩展AI的应用场景,特别是在教育和内容创作领域。

用户头像

开发者小明

昨天

有没有人测试过新的API响应速度?我们正在开发一个实时视频分析应用,非常关注性能表现。

作者头像

AI前线 作者

12小时前

我们测试的平均响应时间在300ms左右,比上一代快了很多,适合实时应用场景。

用户头像

科技观察家

3天前

GPT-4的视频处理能力已经接近专业级水平,这可能会对内容审核、视频编辑等行业产生颠覆性影响。期待看到更多创新应用!