「顶会研究」共找到 3114 篇相关文章
Listen Labs:把用户研究“黑灯流水线”化,AI Agent 系统实现小时级洞察
Listen Labs由两位哈佛校友在2024年底创立,2025年4月获2700万美元融资。今年2 - 5月发布三项核心能力,可实现全流程自动化深访。文章详解其如何实现小时级交付,分析竞争态势与优势,也指出未来待改进处。
Agent 元年已至,我们会拥有自己的智能助理吗?|GAIR Live 预告
2024年被认为是「Agent元年」,智能体浪潮正改写工作与生活。6月14日上午10点,GAIR Live线上圆桌论坛将围绕「Agent」话题展开,5位一线嘉宾探讨其发展阶段、应用方向等关键议题。
陶哲轩再爆:一个月三破18年未解难题!AlphaEvolve彻底改写数学研究规则
一项封尘18年的数学难题,在短短30天内被AlphaEvolve与人类联手三度突破,和差集指数θ从1.173050提升至1.173077,刷新加法组合学天花板,展示了AI与人类协作的新范式。
Energy | 西工大史子颉、高传强等:三维风力机叶片动态失速数据融合建模研究
动态失速威胁风力机叶片安全与发电效率,传统模型有局限。西工大团队开发数据融合神经网络与动量叶素理论耦合框架,能高效高精度预示三维叶片动态失速,虽部分工况有偏差,但预测精度显著提升。
纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究
剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
我不认为几亿人会用豆包「办公」,但 Agent 豆包也必须要做
豆包工作任务新增本地电脑和云电脑切换模式,补上AI Agent关键工作条件,产品定位改变。其优势是低门槛且能力提升,虽Agent不够稳定,但有望成全民工具,推动AI进入大众生活。
刚刚Gemini上新模型,全球只有7人比它会编程,谷歌姚顺宇参与
北京时间周五凌晨,谷歌发布Gemini 3 Deep Think重大升级,在多学术基准测试中取得佳绩,成本大幅降低,编程能力超多数人。在多科学领域表现出色,还推动了实际应用,已上线供部分用户使用。
氛围编程将死!谷歌总监警告:只会写Prompt的程序员,2026年将被淘汰
谷歌云AI总监Addy Osmani称AI编程进入下半场,氛围编程将被取代。AI能提升生产力,但无质量保证,人类专业判断才是关键。他还提出工作模式,强调开发者要结合AI提升能力。
预训练就学会思考!字节、北大等用14亿参数,撬动百亿模型推理能力
字节、北大等联合发布Ouro模型,用14亿参数实现百亿级模型推理能力。它在预训练阶段学会循环思考,通过三大创新构建推理能力,在基准测试中表现优异,实现参数效率提升,是潜在推理范式的胜利。