字节跳动发布豆包 1.5 深度思考模型，具备“看图思考”能力

2025-04-18 10:00:38 439

【导语】4月17日，字节跳动旗下火山引擎在杭州站AI创新巡展上发布了豆包1.5深度思考模型。该模型在数学、编程、科学推理及创意写作等领域表现出色，尤其在数学推理测试中与OpenAI的模型比肩。采用MoE架构的豆包1.5，具备显著的推理成本优势和高并发低延迟的服务能力。同时，其视频搜索能力也得到增强，使用量持续高速增长，日均tokens使用量已超过12.7万亿。

　　4 月 17 日消息，在火山引擎 AI 创新巡展杭州站现场，字节跳动旗下火山引擎总裁谭待发布了最新的豆包 1.5・深度思考模型。

　　据介绍，该模型在数学、编程、科学推理等专业领域及创意写作等通用任务中表现突出。数学推理 AIME 2024 测试得分追平 OpenAI o3-mini-high，编程竞赛和科学推理测试成绩也接近 o1。在创意写作、人文知识问答等通用任务上，模型也展示出优秀的泛化能力，能胜任更(gèng)广(guǎng)泛(fàn)的(de)使(shǐ)用(yòng)场(chǎng)景(jǐng)。

　　技(jì)术(shù)报(bào)告(gào)显(xiǎn)示(shì)，该(gāi)模(mó)型(xíng)采用(yòng) MoE 架(jià)构(gòu)，总(zǒng)参(cān)数(shù) 200B，激(jī)活(huó)参(cān)数(shù)为(wèi) 20B，低(dī)于(yú)业(yè)界(jiè)同(tóng)类(lèi)模(mó)型(xíng)参(cān)数(shù)规(guī)模(mó)的(de) 50%，具(jù)备(bèi)显(xiǎn)著(zhe)的(de)推(tuī)理(lǐ)成(chéng)本(běn)优(yōu)势(shì)。豆(dòu)包(bāo)模(mó)型(xíng) API 服(fú)务(wu)在(zài)保障高并发的同时，延迟(chí)低(dī)至(zhì) 20 毫(háo)秒(miǎo)。

　　谭(tán)待(dài)在(zài)会(huì)上(shàng)详(xiáng)细(xì)介(jiè)绍(shào)了(le)豆(dòu)包(bāo) 1.5 深(shēn)度(dù)思(sī)考(kǎo)模(mó)型(xíng)的(de)强(qiáng)大(dà)功(gōng)能(néng)。该(gāi)模(mó)型(xíng)能(néng)够(gòu)结(jié)合(hé)视(shì)觉(jué)理(lǐ)解(jiě)技(jì)术(shù)提(tí)供(gōng)更(gèng)多(duō)功(gōng)能(néng)，例(lì)如(rú)根(gēn)据(jù)照(zhào)片(piàn)分(fēn)析(xī)地(de)貌(mào)，或(huò)在(zài)旅(lǚ)行(xíng)时(shí)辅(fǔ)助(zhù)点(diǎn)餐(cān)、完(wán)成(chéng)企业项目管理流程图。

　　此外，豆包文生图模型 Seedream3.0 也正式向企业开放。该模型已在即梦 AI、豆包产品上线，并在近期登上权威竞技场 Artificial Analysis 文生图榜单第一梯队。Seedream3.0 支持 2K 分辨率直出，生图结构准确性、小字生成与排版、美感、真实度等方面具有优势。

　　值得关注的是，新模型的视频搜索能力也更强，模型能够根据用户搜索问题在视频中寻找相应答案。

　　同时IT之家注意到，谭待表示，豆包大模型使用量持续高速增长。截至 2025 年 3 月，豆包大模型日均 tokens 使用量超 12.7 万亿，较发布之初增长超 106 倍。

微信公众号搜索“ 新能源 ”加关注，最新环卫前沿洞察、企业动态、产品公告全面了解。推荐关注!

【微信扫描下方二维码可直接关注】

上一篇：暴涨341%只是开始，这家SoC芯片厂商2025年还要接着飙？下一篇：数据短缺阻碍AI一体机落地，专家提出数据元件治理新路径

官方网站-首页

关于

>about

产品中心

>Product Center

应用场景

>Application Scenarios

动态

>News center

运营平台

>Operation platform

合作模式

>

售后服务

>after-sale service

联系我们

>

字节跳动发布豆包 1.5 深度思考模型，具备“看图思考”能力

【微信扫描下方二维码可直接关注】

为美好出行续航

快速充电，随时满电出行～

咨询电话

400-8610 2258

售后服务热线

0755-9956 3377

E-mail：pgSoft@sjzshunbang.com