产业观察

Claude Haiku 5.5:更有品味、更有能力的 6 Luna - AI 前端/3D 能力测试

B站-电脑装机·2026/10/8 16:46:37🔗 原文

📋总体概括

博主对Claude Haiku系列新模型进行了AI前端与3D生成能力的实测,依托「亿模亿样」社区的双盲测试榜单,测试结果公开于gallery.arenaofbias.icu可浏览。结论是该模型相比同门两个更大的模型仍有明显差距,但性价比不错,综合水平大致达到上一代国产模型旗舰的水准,且延续了类似的思考风格。该内容同时是社区共建前端/3D测试基准的一部分,邀请用户参与提问、上传结果与双盲投票。

⚡关键信息

  • ▸博主实测Claude Haiku系列新模型的前端与3D生成能力,测试结果公开于gallery.arenaofbias.icu
  • ▸结论:该模型比自家两个更大的模型弱不少,但性价比表现不错
  • ▸综合水平约等于上一代国产模型旗舰的水准
  • ▸该模型延续了与同门类似的思考风格,作者称其「更有品味、更有能力」
  • ▸排行榜来自亿模亿样的双盲测试,社区号召用户共建可维护的AI前端/3D测试基准

🔥犀利点评

用双盲投票测前端代码审美和能力,这个思路比跑分榜单靠谱得多,毕竟前端生成的「品味」恰恰是传统benchmark测不出来的。至于Haiku本身,小模型打得过上一代旗舰不算新闻,真正值得盯的是它的定价——如果价格够狠,对国产中端模型就是实打实的挤压。但社区自建榜单样本量是硬伤,结论只能当参考,别当真理。

本文由本站自动聚合,以下为原始来源:前往 B站-电脑装机 阅读全文 →