「多模型推理」共找到 10108 篇相关文章

算法论文8

刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习

腾讯混元团队和复旦联合团队发布姚顺雨署名首篇论文《CL - bench》。论文证实模型在上下文利用上有能力短板,还构建了CL - bench评测基准,评估发现前沿模型在上下文学习上表现差,未来要让上下文学习走向现实。

机器之心
开源动态8

智能体编程“小钢炮”:Qwen3.6-35B-A3B开源!

Qwen3.6-35B-A3B开源,是稀疏MoE模型,总参350亿、激活参数30亿,轻量高效,在智能体编程等方面表现卓越,超越前代,可与稠密模型媲美,支持多模态,已在Qwen Studio上线并发布开源权重。

千问大模型
7

3个月手搓Gamma架构,这个团队打造出了场景白盒化推理的“下一代内容OS”

AI应用从生成范式转向任务执行范式,Pi团队3个月手搓Gamma架构,打造出场景白盒化推理的“下一代内容OS”。Pi将AI生成与人的编辑能力结合,解决传统创作难题,实现创作全流程系统内闭环。

量子位
算法论文8

ICLR 2026 | 机器人不够聪明?VLMgineer让大模型自己「发明工具」,从设计到使用全自动

宾夕法尼亚大学研究者提出 VLMgineer,一个全自动工具设计与使用框架,利用视觉语言模型和进化搜索,让机器人自主设计并使用工具。该工作已被 ICLR 2026 接收。实验显示,它在工具设计上优于人类提示和现有 Benchmark 工具。

机器之心
算法论文8

加速近5倍!北大与字节团队提出BranchGRPO,用「树形分叉 + 剪枝」重塑扩散模型对齐

北京大学与字节团队提出 BranchGRPO 新型树形强化学习方法,通过在扩散反演中引入分叉与剪枝,解决扩散/流匹配模型人类偏好对齐难题。该方法在图像与视频生成任务中表现优异,迭代时间最高近 5 倍加速。

机器之心
7

刚刚,GPT-5内测抢先泄露!推理强到离谱,智商被曝140超越人类天才

周五凌晨,GPT-5、GPT-5 Mini和GPT-5 Nano将推出,全网可通过API和ChatGPT访问。GPT-5基准测试结果疯传,实测表现出色。同时,OpenAI发布开放权重模型GPT-oss,登顶开源王座,外媒分析其豪赌开源原因。

新智元
新闻资讯7

大模型公司挖墙脚哪家强?报告:Anthropic人才吸引力是OpenAI的8倍,留存率达80%

风险投资公司SignalFire报告显示,大模型公司人才争夺激烈,Anthropic是大赢家,顶尖AI人才留存率达80%,从OpenAI等公司挖人成效显著,秘诀在于精准挖角、独特文化和产品共鸣。

量子位
开源动态7

小米在AI方向有了大动作,但AI不该是资本掩盖信息的手段。

今年下半年小米MiMo团队陆续开源多个模型,或因年初挖来技术天才罗福莉。新开源MiMo - V2 - Flash模型,总参数量309B。但小米AI对外服务网站搜自家产品舆论无果,引发对AI应坦诚审慎的思考。

开源AI项目落地
推荐文章7

Jina AI创业复盘:AI团队的Scaling Law是什么

文章是Jina AI创始人肖涵的创业复盘。他率团队六年创业后将公司出售,期间两次转型,聚焦搜索底座模型。他分享创业经历、公司命名、业务调整等,还谈收购、模型竞争、未来创业方向及给创业者的建议。

深度学习自然语言处理
新闻资讯7

OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官

Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。

新智元