AI 研究」共找到 10623 篇相关文章

算法论文7

OpenClaw爆火背后,仅8.6%用户能察觉异常!多校联合实证

OpenClaw等AI智能体爆火,其安全隐患凸显。多校联合研究发现,仅8.6%的用户能感知智能体媒介欺骗,总结了6类认知失效模式,认为体验式学习或比静态提醒更能提升用户警觉性。

新智元
推荐文章7

谁为 Data Agent “买单”?

Kyligence联合创始人李扬围绕AI数据智能体服务对象及带来的转变分享思考。它能解决领导数据客观性、时效性等问题,也助分析师深入研究,最大价值是让业务人员从0到1用上数据,推动企业数智化转型。

InfoQ
新闻资讯8

Ilya重新定义AGI: 为什么ChatGPT离真正的AGI还很远

OpenAI前首席科学家Ilya在访谈中提出对AGI的新定义,还指出AI规模时代结束,未来拼想法和研究深度。他分析模型评测强但经济影响弱的原因,阐述人类价值函数作用,且SSI战略或调整。

花叔
算法论文8

SPIRAL:零和游戏自对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
7

前两天刚被群嘲,ChatGPT转头就解决了一个数学难题

前些天,OpenAI研究员宣称GPT - 5‘发现’数学难题解法被指只是检索文献引群嘲。但加州大学洛杉矶分校教授用ChatGPT解决凸优化未决问题,还有教授用其发现命题反例,甚至要将其列为论文一作,AI正成研究伙伴。

机器之心
新闻资讯8

联手 OpenAI 发布 ACP,Stripe 是如何思考 Agent 支付的?

今年 9 月,OpenAI 与 Stripe 联合推出 ACP,重新定义支付。本文整理了 Stripe 的 Head of Data & AI Emily 的访谈,介绍 ACP 本质、Stripe 与 AI 公司的商业模式探索,以及 Stripe 自身的 AI 应用和对 AI 宏观影响的看法。

海外独角兽
新闻资讯7

40位数学家组成8队与o4-mini-medium比赛,6队败北

Epoch AI安排40位数学家组成8支战队,与OpenAI的o4 - mini - medium模型对决,考题来自高难度的FrontierMath数据集。结果AI以6:2击败人类,不过Epoch AI认为AI未明显超人类,但很快会达到。

机器之心
新闻资讯8

百度:和大家一起讲 「超级有用」的故事

作者参加百度AI DAY智能云创新行业专场,看到百度全栈AI解决方案矩阵及应用案例。百度通过构建生态、全栈自研、推动科技平权等举措发力AI,诸多应用已取得商业成果,有望在AI商业化长跑中胜出。

MacTalk
算法论文7

一句话,性能暴涨49%!马里兰MIT等力作:Prompt才是大模型终极武器

马里兰大学、MIT、斯坦福等机构研究发现,AI性能提升一半靠模型,一半靠提示词。他们让DALL - E 2和DALL - E 3 PK,发现DALL - E 3性能提升中,模型升级贡献51%,提示词优化贡献49%。

新智元
开源动态8

北大、字节跳动联手发布SWE-Swiss:一把修复代码Bug的「瑞士军刀」,完整配方直指开源SOTA

北大、字节跳动等联合研究提出SWE - Swiss配方,用于训练解决软件工程问题的AI模型。32B参数的SWE - Swiss - 32B在SWE - bench Verified上准确率达60.2%,各训练环节效果显著,模型和数据将开源。

机器之心