新物质发现」共找到 4361 篇相关文章

8

100 页 Agentic RL 综述!牛津、国立、AI Lab 等联合定义 LLM 下半场

2025 年大语言模型热潮持续,但当前主流训练范式显瓶颈。牛津、国立等 16 家机构学者发布 100 页 Agentic RL 综述,明确定义从‘会说’到‘会做’进化路径,剖析理论、结构与实践,展望未来挑战。

特工宇宙
推荐文章7

架构师困境:选择已被验证的道路,还是自行开辟一条路?

开发软件时,团队要做产品功能和架构决策,面临选已验证路径还是自辟路的困境。使用平台和框架虽能加快开发,但有副作用。团队需通过实验判断何时扩展或替换平台。

InfoQ
算法论文8

VLM剪枝SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供思路。

新智元
算法论文7

OpenAI幻觉论文惹争议!GPT-5拉胯是测试基准有问题??

OpenAI论文《语言模型为何会产生幻觉?》提出,模型有幻觉是因标准训练和评估流程倾向奖励“猜对”。GPT - 5不爱猜测,在榜单表现不佳,网友质疑论文是为GPT - 5挽尊,论文引发网友多方向讨论。

量子位
新闻资讯7

陶哲轩回应OpenAI模型IMO夺金!GPT-5测试版也曝光了

OpenAI模型在2025年IMO达金牌水平,GPT - 5也将发布。但陶哲轩指出缺乏统一测试标准,影响公平比较。MathArena测试中,Gemini 2.5 Pro仅13分,远低于铜牌线。

量子位
新闻资讯7

Claude Code一周份额,一天就烧完一半?有人逆向工程发现了7个bug

Claude Code在快速更中问题频发,如思考深度大幅下降,还存在7个叠加的bug,浪费用户token配额。开发者给出应对建议,版本增加账单透明度和缓存过期提醒,该工具正面临信任危机。

机器之心
产品应用7

Karpathy又双叒叕发概念了,这次我替你找到了那个产品

Andrej Karpathy提出将LLM算力用于建知识库,引发关注但搭建有门槛。网易有道出的有道宝库功能类似,能自动理解整理资料,有追问、多模态输出等功能,还打通翻译链路,目前免费内测。

花叔
开源动态8

鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的标杆

RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创设计揭示模型不足,为研究者提供方向,推动具身智能实用化。

AI科技评论
算法论文8

Science重磅!发现提速千万倍,清华用AI把药物筛选变成向量检索

清华大学团队在《科学》发表DrugCLIP研究,将对比学习引入药物发现,把分子对接转为向量检索,使虚拟筛选速度提升千万倍,还构建全球首个全人类蛋白质组药物筛选数据库。

AIGC开放社区
开源动态8

达摩院推出多智能体框架ReasonMed,打造医学推理数据生成范式

在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成范式,开源百万级高质量数据集ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。

机器之心