火山引擎谭待:“AI普惠,我们这次尽全力了”

2025-06-25 18:32:57 71

“你问我爱你有多深,我爱你有几分,我的情也真,我的爱也真,月亮代表我的心。”2025年6月11日,在国家会议中心的会场,一首老歌响了起来。这并不是某位歌手的演唱会,而是豆包大模型的AI演唱。如今的豆包大模型,既可自动操作浏览器完成酒店预定,识别购物小票并整理成Excel表格等任务,还让瑞幸咖啡基于它打造了首个AI点单智能体,能够实现语音下单、猜你喜欢、点单更省时等功能,为用户带来“动动嘴就能点咖啡”的全新咖啡消费体验。

就在当天的会场,字节跳动旗下火山引擎举办了Force原动力大会。会上,火山引擎总裁谭待展示了豆包大模型的更多功能,他表示:“有媒体针对高考全国新一卷数学单科做了测评,豆包的成绩是144分,全国第一。而在高考前,我们针对海淀区模拟全卷进行了测评,豆包1.6相对2024年理科成绩显著提升了154分,文科提升了90分。”与此同时,本次会上火山引擎还为大模型做了“上新”。当天,其发布了豆包大模型1.6、视频生成模型Seedance 1.0 pro等新模型,并升级了Agent开发平台等AI云原生服务。

性能跻身全球前排,价格“便宜大碗”

豆包1.6系列当前由三个模型组成,分别是doubao-seed-1.6;doubao-seed-1.6-thinking和doubao-seed-1.6-flash。

doubao-seed-1.6是all-in-one的综合模型,也是国内首个支持256K上下文的思考模型,它支持深度思考、多模态理解、图形界面操作等多项能力。特别是在深度思考方面,开发者可以选择关闭深度思考、开启深度思考和自适应思考三种方式。在自适应思考模式之下,模型可以根据prompt难度自动决定是否开启thinking,在提升效果的前提之下可以大幅减少tokens开销。

doubao-seed-1.6-thinking,是1.6系列在深度思考方面的强化版本,它只支持深度思考模式,但在coding、math、逻辑推理等基础能力上都有进一步提升,同时也支持256K上下文。

doubao-seed-1.6-flash,是1.6系列的极速版本。它同样支持深度思考、多模态理解和256K窗口。但是,它的延迟极低输出每个 Token 的时间仅需10ms,适用于延迟敏感场景。其文本理解能力超过doubao 1.5 lite,视觉理解能力可以比肩友商旗舰模型。

会上,火山引擎披露了豆包1.6模型的多项权威测评成绩。在复杂推理、竞赛级数学、多轮对话和指令遵循等测试集上,豆包1.6-thinking的表现已跻身全球前列。据谭待介绍,豆包1.6系列模型支持多模态理解和图形界面操作,能够理解和处理真实世界问题。此前,豆包1.5的多模态能力在60个公开评测基准中取得38项最佳成绩,并已广泛用于电商识图、自动驾驶数据标注、门店巡检等场景。图形界面操作能力则让豆包1.6进一步具备“行动力”。与此同时,谭待还独家揭秘了豆包APP的小流量DeepResearch功能。通过该功能,过去需要多名专业人士花费数小时或者几天写成的调研报告,豆包可以在5-30分钟内完成,报告不仅内容扎实、结构严谨,还能自动提炼信息总结成网页方便查阅。

豆包视频生成模型Seedance 1.0 pro也在本次会上亮相。该模型支持文字与图片输入,能够生成多镜头无缝切换的1080P高品质视频,主体运动稳定性与画面自然度较高。该模型还具备无缝多镜头的能力,这让它能在几秒的视频中生成2个以上镜头的切换,并能伴随着远中近景画面变化,让画面的信息量和叙事能力大幅提升。基于以上模型特点,火山引擎在电商、游戏和影视等场景使用Seedance 1.0 pro 分别做了尝试。比如,在电商领域,无缝多镜头、多动作多主体互动等能力可以让产品展示更加丰富。在影视领域,可以帮助从业人员快速验证分镜与叙事逻辑,减少前期筹备成本。在游戏领域,其用网易出品的常青仙侠游戏《逆水寒》做了尝试,让用户创作自己的角色故事“亲身”演绎剧情。在国际知名评测榜单 Artificial Analysis 上,Seedance在文生视频、图生视频两项任务上均排名首位。

目前,豆包大模型已涵盖多模态、视频、图像、语音、音乐等模型品类,全方位推进智能提升和应用落地。在行业应用上,豆包大模型服务着全球TOP10手机厂商中的9家、8成主流汽车品牌、70%的系统重要性银行及超5成985高校。谭待表示:“在手机行业,全球Top10手机厂商有9家和火山引擎深度合作。在汽车行业,在刚刚过去的上海车展,豆包大模型是被最多提及的名词,我们还携手长安汽车解决大模型安全测评的合规风险,护航智能化发展。在金融行业,火山引擎已经服务华泰证券、国信证券等数十家券商和基金公司,以及已经服务招商银行、浦发银行、民生银行等70%的重要性银行。在教育行业,火山引擎已与北京大学、浙江大学、南开大学等超五成985高校达成合作,持续推动高等教育智能化转型。”数据显示,豆包大模型日均tokens使用量超过16.4万亿,较2024年5月首次发布时增长137倍。另据IDC报告,豆包大模型在中国公有云大模型市场份额排名第一,占比高达46.4%。与此同时,豆包1.6成本下降了63%,企业只需要原来三分之一左右价格,就能获得一个能力更强的原生多模态新模型。

谭待表示,深度思考、多模态和工具调用等模型能力的提升,是构建Agent的关键要素。同时,由于Agent每次执行任务都会消耗大量tokens,因此只有把模型使用成本也降下来,才能推动Agent的规模化应用。而通过技术和商业的双重创新,豆包1.6首创按“输入长度”区间定价,深度思考、多模态能力与基础语言模型统一价格。在企业使用量最大的0-32K输入区间,豆包1.6的输入价格为0.8元/百万tokens、输出8元/百万tokens,综合成本只有豆包1.5深度思考模型或DeepSeek R1的三分之一。Seedance 1.0 pro模型每千 tokens仅0.015元,每生成一条5秒的1080P视频只需3.67元,为目前的行业最低。“另外,我们还观察到一个数据,那就是仍然存在大规模non-thinking模型的需求,而且这些请求的输出都非常短。所以,这次我们还特别增设了一个特惠区,对于输入32K、输出200以内的请求,豆包1.6的价格将进一步降低到每百万tokens输入0.8元和输出2元。这意味着绝大部分的non-thinking需求,仍然可以继续享受和豆包1.0一样的超低价格。AI普惠,我们这次尽全力了。”谭待表示。

图:火山引擎总裁谭待

发布两款AI安全产品和三款Agent方案,让Agent规模化应用提速

为应对Agent运行的各类挑战,火山引擎发布了两款AI安全产品:一是AICC密态计算,它通过用户个人密钥加密、CPU/GPU硬件可信环境计算推理、数据流转落盘全密文的方式,在保障推理效果的前提下,让企业像使用私部模型一样安全合规的使用云端模型。二是大模型应用防火墙,它脱胎于火山方舟每天十六万亿tokens服务的防护过程,通过精调的小参数模型、分层漏斗策略和流式送检机制,低延迟、高精度的拦截攻击变种,为企业智能体应用构建安全可信的大模型推理空间。通过这两款产品,企业不仅可以安全的使用云上AI服务构建端云协同体系,还能有效保障AI资产和服务资源。

与此同时,火山引擎还发布了三个Agent方案:AgentKit,TrainingKit和ServingKit,帮助企业更高效地做好Agent服务、模型训练和模型推理。

AgentKit,是一套为企业级Agent打造的全栈开发和服务工具链。AgentKit 集成了豆包大模型,支持开源UI-Tars模型和最新豆包1.6模型,能够帮助企业通过模型快速生成Agent逻辑和工具调用。针对Agent Sandbox环境,通过火山引擎veFaaS预置应用模版可以实现开箱即用,并通过容器服务实现了分钟级的 10 万核高速扩容能力,保障了应用的可用性。与此同时,火山引擎开发套件构建了完整的工具生态体系,支持Computer Use、Browser Use、Phone Use等Tool Use,并覆盖了数十类三方MCP Server,从而能够大幅降低Agent开发的工程复杂性。

TrainingKit,是一款云原生训练套件,能实现高达 60%+ 的MFU(算力利用率),在万卡集群、千亿参数模型训练的集群上,算力利用率相比提升了30%。同时面向后训练环节,Training Kit通过 veRL 框架、 Sandbox 百万核秒并发能力,能够有效提升后训练效率,为 AI 训练全流程筑牢技术底座。

ServingKit,是面向模型部署与推理的AI云原生推理套件,能从模型部署、在线推理、服务运维三个阶段进行加速和提效。特别是在推理优化阶段,它能始终保持开放兼容,广泛地支持开源推理框架,并能针对主流模型进行算子优化,性能相比社区最新版本提升2-3倍。

字节跳动技术副总裁洪定坤认为,随着模型能力的持续进步,AI将有机会成为调度者,通过调用不同的 Agent 和工具,让软件开发“all in one”,从而能够更大幅度地降低开发门槛,提升开发效率。洪定坤表示,豆包1.6模型在编程能力上进步很大,目前已经接入字节的AI编程产品TRAE内测,新模型将很快推送给用户。据洪定坤透露,在字节内部,超过80%的工程师在使用TRAE辅助开发。TRAE 的整体月活用户已经超过了 100 万。在演讲中洪定坤举例称:“我们一位研发同事的孩子大概11岁,最近这个孩子在做一些奥数题目,他觉得用纸做的方式不是很方便,而网上有各种不同题目,于是他想有没有可能做一个小网站把这些题目自动抓下来。于是,这名孩子使用TRAE开发了一个网站,这是一个真实的网站,可以在上面做题。由此可见,一个11岁的小朋友,在AI的帮助下也能很快地通过自己学习完成一次开发和生成一个应用。”

图:字节跳动技术副总裁洪定坤

可以说,在AI时代,开发范式将首先发生重大变化。过去,无论是LAMP、SOA还是容器化、微服务,本质都是通过程序员来编写算法和规则。而在AI时代,调用中心从程序员转移到大模型。大模型和Agent开发平台是AI时代的关键要素。模型只有实现强推理、多模态和低成本,才能支撑好Agent的大规模应用。同时,需要提供强化学习、Prompt优化、MCP Hub、知识库、运行沙盒等开发平台,以便基于模型开发出更好的Agent。

谭待认为,技术主体经历了三个时代变化,AI时代会推动开发范式与技术架构全面升级。他说:“PC时代主体是Web,移动时代是APP,AI时代则是Agent。Agent能够自主感知、规划和反思,完成复杂任务。从被动工具转变为主动执行者。豆包大模型和AI云原生将持续迭代,助力企业构建和大规模应用Agent。”他总结称:“我们(得到认可)的诀窍就是心诚,就是你真心想做这件事情,不是把不好的模型免费赚一个吆喝说你看我赋能了多少开发者,而是要让更多人运用AI创造价值。这之中主要涉及到三件事:把模型做好、把成本做低、以及把应用性和落地性工具做好”。同时,谭待还表示:“目前模型带来的业绩增长在所有产品中是最快的,同时也远超其他产品,而且也是毛利最好的产品之一,我觉得这个业务还是非常值得期待的。”

新闻动态

热点资讯

推荐资讯