多模型 Agent」共找到 10791 篇相关文章

算法论文8

AAAI|东方理工陈云天等:教会视频扩散模型“理解科学现象”,从初始帧生成整个物理演化

东方理工陈云天等团队在论文中提出让视频扩散模型学习“潜在科学知识”的框架,方法分三步,在流体和台风数据实验中表现超主流方法,展示生成式AI在科学建模的探索。

力学与人工智能
新闻资讯7

拾象 AGI 观察:LLM 路线分化,AI 产品的非技术壁垒,Agent“保鲜窗口期”

这是「海外独角兽」的AI领域观察栏目访谈,拾象CEO李广密和财经作者张小珺梳理LLM领域信号。2025 Q2全球大模型爆发性强且分化,还提到AI Labs路线、产品壁垒、“保鲜窗口”及Agent体验等内容。

海外独角兽
开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度

模态大语言模型应用元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在基准数据集成果突破性领先。

量子位
7

Meta新模型逼平Fable 5,小扎:开源且便宜到你懒得算账

Meta推出新模型Muse Spark 1.3,在Artificial Analysis榜单中与Fable 5打平手。小扎称其在Coding和Agent工作有大幅提升,还便宜。网友实测它真能肝、真能省,Meta团队核心研究员也透露背后改动。

量子位
算法论文8

68页论文再锤大模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩

《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数大厂私下版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被大量静默弃用等,研究团队给出改进建议,官方也进行了回应。

量子位
算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
新闻资讯7

谷歌深夜放出 IMO 金牌模型项测试力压 Grok 4、OpenAI o3!网友评论两极分化

8月1日晚谷歌向Ultra订阅用户推Deep Think功能,Gemini 2.5 Deep Think模型在IMO夺冠。它是智能体模型,能并行处理问题。项测试中表现优于Grok 4、o3,不过网友评价不一。

AI前线
产品应用7

全球首个龙虾模型 GLM-5-Turbo 发布:已经在用它帮我省几千块钱了

作者作为公众号编辑,排版耗时久费钱。他测试模型驱动龙虾排版均失败,换上智谱 GLM - 5 - Turbo 后成功,还能让其操作飞书润稿。该模型工具调用稳定,虽 API 涨价但性价比高,未来潜力大。

特工宇宙
算法论文8

Attention真的可靠吗?上海大学联合南开大学揭示模态模型中一个被忽视的重要偏置问题

上海大学曾丹团队联合南开揭示Vision - Language Models中普遍的attention偏置问题,提出无需重训的去偏方法,在模型、策略及基准上验证有效性,为模态模型部署提供新思路。

机器之心
开源动态8

百川开源医疗增强大模型 Baichuan-M2:更符合中国临床诊疗场景,可 4090 单卡部署

百川智能发布并开源医疗增强大模型 Baichuan-M2,以更小尺寸反超 OpenAI 新模型。它可 4090 单卡部署,成本低,在 HealthBench 评测表现佳,免费开源,更适配中国临床诊疗场景。

InfoQ