产业观察🔥7.0

豆包大模型 1.8 发布,通用 Agent 模型成为了 AI 行业的新叙事

极客公园·2026/9/28 12:44:02🔗 原文

📋总体概括

字节发布豆包大模型1.8,重点增强Agent支持能力,在Coding和工具使用之外押注OS Agent方向,让模型不仅能搜索和写代码,还能「看见」世界并进行交互。同时配套发布基于现实世界任务的新评测体系Evaluation System。文章指出,2025年AI行业从DeepSeek R1和Manus开局,最终回归基模主线叙事:谁对Agent支持更好、Coding更强、工具用得好,谁才是开发者的选择,解决现实复杂任务的能力取代榜单分数成为衡量模型的新标准,通用Agent模型成为行业新叙事。

⚡关键信息

  • ▸字节发布豆包大模型1.8,核心增强方向是通用Agent支持能力
  • ▸豆包1.8选择OS Agent作为更有想象力的场景,强调模型能「看见」世界并交互
  • ▸同步发布基于现实世界任务的全新Evaluation System评测体系
  • ▸2025年AI行业以DeepSeek R1和Manus开局,年底回归基模本身的主线叙事
  • ▸衡量模型的新标准从榜单分数转向解决现实世界复杂任务的能力

🔥犀利点评

榜单刷分时代结束了,Agent成了新的军备竞赛。字节这步棋不难理解:豆包在纯模型能力上追OpenAI和Anthropic始终吃力,但OS Agent和现实任务评测是还没定规矩的新战场,谁先定义评测标准谁就掌握话语权。这套Evaluation System比模型本身更值得盯——写规则的人,往往赢下下半场。

本文由本站自动聚合,以下为原始来源:前往 极客公园 阅读全文 →