推理场景」共找到 3728 篇相关文章

开源动态8

追平GPT-4o,数学基测96.3%高分,Hermes4 来了

Nous Research推出新一代大模型Hermes 4系列,其有混合推理和长度控制机制,还能用DataForge“造”数据,经Atropos质检。它在数学等领域表现佳,追平GPT - 4o,是开源AI对巨头的挑战。

AIGC开放社区
开源动态8

清华团队开源发布首个结构化数据通用大模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用大模型。它融合结构因果推断与预训练技术,适配多任务,性能超最优专用模型,已落地多个工业场景

AI科技评论
新闻资讯7

2025CSDI:大模型引领智能研发与IT组织变革

文章指出AI发展将推动私有知识价值增大,其应用成战略重点。如DeepSeek打破行业固有观念,引领变革。未来智能时代经济源于智能体,AI重构企业生产力,2025CSDI峰会将探讨相关场景应用。

AIGC开放社区
产品应用7

怎么从 ChatGPT 拿流量?送上这九条实用建议

文章指出AI问答引擎成B2B采购决策重要‘守门人’,介绍问答引擎优化(AEO)概念,还通过采访提炼九条从ChatGPT等拿流量的实用建议,如明确提问场景、了解平台差异等。

Founder Park
算法论文8

一个标点就能迷惑LLM-as-a-Judge!

论文揭露惊人漏洞,一个标点或通用推理开场白就能欺骗最先进的LLM裁判,导致强化学习训练崩溃。研究通过实验验证漏洞,提出Master - RM模型,其FPR近乎0%且保持通用裁判能力。

深度学习自然语言处理
算法论文8

换个地面/身体,机器人策略就失灵?让扩散策略读懂「动力学」| ICML'26

扩散策略成机器人控制热门路线,但真实世界动力学多变,策略易失灵。UC Berkeley等联合提出DADP,训练统一策略,在零样本跨域控制任务表现强,尤其在OOD场景优势明显,还给出工程补充结果。

新智元
算法论文8

脸谱心智陆弘远团队ACL 2026新作:别再给模型叠加「高级词」了!模型更爱听「大白话」

脸谱心智与香港中文大学科研人员中稿 ACL 2026 的新工作提出 Adam’s Law,即文本频率定律,揭示文本频率对模型训练及推理的重要性,还给出工程解法,实验效果显著,为行业带来新思路。

机器之心
开源动态8

国产开源LLM迎来大爆发的一周:Kimi、腾讯、快手、美团、面壁智能

国产开源大模型迎来爆发,快手、月之暗面、美团、面壁智能、腾讯等接连发布新模型,如快手Keye-VL - 1.5 - 8B刷新视频理解SOTA,美团LongCat - Flash - Chat推理快成本低等。

PaperAgent
算法论文7

机器狗能当羽毛球搭子了!仅靠强化学习从0自学,还涌现出类人回位行为 | Science子刊

苏黎世联邦理工学院团队让机器狗靠强化学习学会打羽毛球,开发全身视觉运动控制策略,使其最高挥拍速达12米/秒,还涌现类人回位行为,研究证明足式机器人在体育场景应用可行。

量子位
新闻资讯7

凭借 27 万小时真机数据,Generalist 可能是最接近“GPT-1 时刻”的顶级机器人团队

Generalist是机器人领域有潜力的公司,凭借27万小时真机数据或达GPT - 1量级,领先6 - 12个月。团队成员来自顶尖机构,技术强,demo展示出模型灵巧性。不过也面临Scaling Law不确定、数据缺口大、商业化场景缺失等风险。

海外独角兽