7
国产大模型“高考”:豆包文科夺冠
量子位
AI 摘要
字节跳动Seed团队公布大模型“高考成绩”,Gemini理科第一,豆包文科第一、理科第二。评测公平公正,还分析各科目表现。豆包靠三招提升能力,全模态推理潜力大。
阅读原文 · 量子位
国产大模型高考出分了:裸分683,选清华还是北大?
字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用8
豆包新增模式,有望成全民AI工具
豆包工作任务新增本地电脑和云电脑切换模式,补上AI Agent关键工作条件,产品定位改变。其优势是低门槛且能力提升,虽Agent不够稳定,但有望成全民工具,推动AI进入大众生活。
刘言飞语
产品应用7
黄叔实测:豆包本地云双模式超惊艳
黄叔实测豆包「工作任务」模式,其有独特的本地/云电脑双模式。本地能分析电脑内存问题,云端可处理监控任务,还能助力开发复杂项目,且Skill自动接入,与本地电脑实时同步。
AI产品黄叔
算法论文7
Gemini、GPT进《我的世界》评测,新框架破瓶颈
国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。
AI科技评论
产品应用7
豆包升级为工作 Agent,功能大爆发!
最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。
MacTalk