字节跳动豆包发布“Doubao-Seed-Evolving”模型,专注编程与智能体场景持续迭代
字节跳动旗下火山引擎近日对豆包大模型家族的Seed系列进行更新,推出Doubao-Seed-Evolving模型。该模型采用统一Model ID,上线后版本将自动升级,开发者无需更换模型名称或迁移Endpoint,即可持续获取最新版本。
官方表示,Doubao-Seed-Evolving将聚焦编程(Coding)和智能体(Agent)场景,并以高频次进行升级。首次升级已完成,核心变化包括:上下文窗口扩大至1M tokens;长程任务稳定性显著提升,在Claude Code、Hermes、Openclaw框架的开发者众测盲评中,质量评分明显超越上一代Seed-2.1-pro;tokens效率优化,工具调用轮次更加简洁。
“我们会聚焦Coding和Agent场景,并以高频的速度升级。持续使用Doubao-Seed-Evolving的开发者,将感受到肉眼可见的模型进步速度。”官方在模型卡片中写道。
关于接入方式,开发者可在配置文件~/.claude/settings.json中添加环境变量,设置ANTHROPIC_MODEL为“doubao-seed-evolving”,并配置ARK API Key及Base URL。
在实测中,该模型展示了多项能力。在一次前端项目改造任务中,模型使用Vite + React,在3分56秒内完成了一个大学生就业补贴公益网站的前端重建,并自主选择了暖米白底搭配赭石主色的配色方案,实现了搜索、城市筛选、可信度筛选及响应式设计,随后将代码提交至GitHub并完成线上部署。
在数据分析任务中,模型对约5000个X(原Twitter)平台的AI账号进行营销号识别。它先拉取了近几天活跃的2745个账号、99801条推文的数据,自主编写打分分类器,并经过多轮规则修正,最终从2745个嫌疑账号中确认27个营销号,其中15个被建议强烈取关,7个倾向取关,5个建议人工复核。模型还生成了HTML核对页面便于用户操作。
在AI Lab招聘信息扩展任务中,模型通过子agent方式,花费29分钟调研了各公司招聘系统的可访问性,最终建议新增13家AI Lab的招聘采集(海外7家、国内5家,以及字节跳动本身的招聘信息),并完成采集上线。新增后,招聘页覆盖32家公司、约6000个岗位。其中,字节跳动全集团岗位经关键词和正则筛选后,保留了940个前沿岗位;Qwen(千问)团队的招聘信息则通过阿里自研招聘portal,以cookie加XSRF流程获取到28个岗位。
模型在处理Logo修复任务时,展现了其视觉理解(VLM)能力。它通过“亲眼”查看图片,判断出13家新公司Logo中的8张存在问题,并自行通过网络获取、格式转换、升采样等方式,最终全部替换为真实品牌图标。
模型还对自身工具调用量进行了统计:仅Jobs任务的四轮对话中,工具调用共388次,其中调研子agent单独运行了260次。
在费用方面,用户账户初始余额约100.71元,完成上述全部测试后账户欠费6.39元,总计花费约107元。官方也提供了火山引擎“Agent Plan”服务,9.9元/月即可使用Seed-Evolving模型。
距离上一代Seed-2.1-pro-preview发布仅三周时间,Doubao-Seed-Evolving即在编程、前端、长程任务和工具使用方面展现出快速迭代能力。目前,该模型已可通过火山引擎ARK平台接入使用。
