研究Agent」共找到 4382 篇相关文章

算法论文8

全球顶尖AI做物理,被人类按地摩擦?不懂推理大翻车,本科生碾压

港大等机构用3000道物理题测试顶尖大模型,如GPT - 4o、Claude 3.7 Sonnet等,结果模型准确率远低于人类专家。研究推出PHYX基准测试,揭示模型依赖知识、公式和模式匹配,缺乏真正物理理解。

新智元
开源动态8

Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动小模型

Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。

量子位
新闻资讯7

AI「自我复制」能力曝光!RepliBench警示:大模型正在学会伪造身份

英国AISI推出RepliBench基准评估AI自主复制能力,分解为四大核心能力。测试显示当前AI尚不具备完全自主复制能力,但在部分子任务有进展,研究旨在平衡AI发展与安全,为技术变革导航。

新智元
推荐文章8

骂谷歌干蠢事、炮轰甲骨文、AI在真实数据库测试得分为0!83岁图灵奖数据库教父的硅谷“狂人日记”

本文是对图灵奖得主、Postgres 奠基者 Mike Stonebraker 的访谈。他直言大模型 Text - to - SQL 在真实数据库测试得分低,批评谷歌、甲骨文等公司做法,还探讨数据库未来,如 Agent 读写与数据库结合、DBOS 技术等。

AI科技大本营
开源动态8

对话港大黄超、任旭滨:龙虾热潮、nanobot、CLI与AI开源方法论|甲子光年

本文是甲子光年对港大黄超、任旭滨的访谈实录。二人介绍多个开源项目,如nanobot、ClawWork、CLI - Anything等,探讨OpenClaw热潮,认为焦虑与机会并存,还分享团队开源理念与研究方向选择方法。

甲子光年
算法论文8

普林斯顿大学等Nature揭秘:人类大脑与大语言模型共享同一套语言处理时钟

普林斯顿大学等机构研究发现,大语言模型层级计算序列精确映射人类大脑处理语言的毫秒级时间动态,其与人类大脑理解语言的先后顺序高度一致,为理解大脑和开发神经网络架构开辟途径。

AIGC开放社区
算法论文8

3D-R1:让AI理解3D世界的下一步

文章介绍新研究3D - R1,它是更通用、具推理能力的三维视觉语言模型,解决了当前3D VLM空间理解不足与推理能力薄弱问题,在多任务测试领先,有广阔应用前景。

机器之心
新闻资讯8

一篇被证明“理论有误”的论文,拿下了ICML2025时间检验奖

2015年发表的Batch Normalization论文在ICML 2025会议获时间检验奖。它引用超6万次,推动了深层神经网络发展。虽2018年被指理论有误,但仍有新研究发现其对训练过程的根本影响。

量子位
新闻资讯7

Token需求狂飙千倍,22亿热钱涌向这家AGI Infra头号玩家

在AI基础设施成风口的背景下,国内AGI Infra头部玩家无问芯穹获超7亿融资,其Token调用量爆发式增长。随着AI产业进入Agent阶段,传统架构难适配新需求,无问芯穹以中立定位成Token经济枢纽。

量子位
算法论文8

揭秘 | 桥梁缺陷检测新突破:模型压缩42%,精度几乎不掉

全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创新实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。

机器学习AI算法工程