产品应用8
字节豆包 Seed 2.0:多模态能力大升级
MacTalk
AI 摘要
池建强:字节发布的豆包 Seed 2.0 在多模态理解和执行任务能力上表现出色,如处理世界杯视频、规划旅行、生成游戏等,且字节重原生能力而非简单蒸馏。
阅读原文 · MacTalk
豆包 Seed 2.0 来了:字节模型跨越鸿沟
春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
SWE - Touch揭示Coding Agent共享协作能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。
深度学习自然语言处理
算法论文7
MLS - Bench评测:AI科研创新能力待提升
新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。
新智元
开源动态8
腾讯 WorkBuddy 开源评测,曝光多模型底牌
腾讯 WorkBuddy 团队将内部模型选型评测等开源成 Benchmark,公开多模型 Agent 工作台选型底牌。Bench 优点是任务分布真实且开源可审计,论文介绍了核心方法论、四大赛道拆解、榜单结果,还对比了现有工作。
PaperAgent
新闻资讯8
OpenAI揽菲尔兹奖得主,字节布局科研
今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。
机器之心