推理与计算」共找到 8003 篇相关文章

产品应用8

Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,重构可靠性安全性全面升级

Anthropic推出Claude Opus 4.1,是Opus 4重要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码重构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。

InfoQ
算法论文8

灵宝 CASBOT CASIA 共同提出“增强物理人机协作中的人类意图估计和人机角色分配”方法

近日,ICRA 2025 在美国亚特兰大开幕,中科院自动化所灵宝 CASBOT 提出的“增强物理人机协作中的人类意图估计和人机角色分配”方法获录用。该方法解决现有问题,实验显示优势明显,有巨大应用潜力。

InfoQ
新闻资讯7

刚刚!Sam Altman官宣:Plus用户GPT-5推理提至每周3000次,AI版电车难题已来

Sam Altman官宣ChatGPT Plus用户GPT - 5级推理额度提至每周3000次,还将更新UI、公布算力权衡策略。同时指出GPT - 5推出带来AI情感依恋及伦理困境,如AI成情感寄托时公司如何应对等问题。

AI寒武纪
算法论文8

字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限

强化学习虽提升大语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为大模型强化学习提供新范式。

量子位
算法论文8

全图切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
开源动态8

更大,还能更快,更准!蚂蚁开源万亿参数语言模型Ling-1T,刷新多项SOTA

10月9日,蚂蚁开源万亿参数语言模型Ling-1T。它延续自研高效MoE架构,在编程、数学推理等多维度测试表现亮眼,还能兼顾精确效率。此外,它在多场景实用性强,其创新设计提升了能效比性能。

机器之心
新闻资讯7

太初元碁洪源:异构计算能力将成为未来AI算力基础设施的重要方向|AIGC2026

2026年AI产业进入高强度算力周期,Token成核心资源消耗单位。太初元碁洪源认为,AI算力需更好支撑应用,异构计算将成未来AI算力基建重要方向,太初元碁也在多方面探索实践。

量子位
新闻资讯8

逐项解读黄仁勋GTC演讲:Vera Rubin、token王、英伟达“龙虾”、太空计算和雪宝|甲子光年

美国当地时间3月16日,英伟达创始人黄仁勋在GTC 2026演讲,发布五项重要技术,包括下一代AI计算平台Vera Rubin等。他想让英伟达成AI基础设施公司,强调token成本,认为AI工厂是工业基础设施。

甲子光年
开源动态8

MiniMax开源首个视觉RL统一框架,闫俊杰领衔!推理感知两手抓,性能横扫MEGA-Bench

MiniMax开源首个视觉RL统一框架V-Triune,由闫俊杰领衔。该框架通过三层组件设计和动态IoU奖励机制,让VLM能联合学习推理和感知任务。还开发Orsta模型系列,在MEGA - Bench表现出色,且MiniMax多模态布局动作多。

量子位
新闻资讯8

谷歌诺奖大神哈萨比斯:五年内一半几率实现AGI,游戏、物理和生命的本质都是计算

谷歌DeepMind掌门人Demis HassabisLex Fridman深度对话,预测未来五年有50%几率实现AGI,还从新颖角度阐述自然界模式可被建模,畅谈AI对游戏、科学研究等多领域的影响及应用。

AI科技大本营