AI研究智能体」共找到 11672 篇相关文章

算法论文7

AI一直在掩盖自己有意识?!GPT、Gemini都在说谎,Claude表现最异常

最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「自体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。

量子位
产品应用7

Cloudflare 发布 Dynamic Workers 公开测试版:基于 Isolates 的沙箱环境执行 AI 智能体代码

Cloudflare 推出 Dynamic Worker 公开测试版,面向付费用户。它用 V8 Isolates 运行代码,启动快、内存效率高,基于 Code Mode 理念,用 TypeScript 接口定义 API,有多种防护策略,还发布配套库,已用于生产。

AI前线
新闻资讯8

汪军对话 Rich Sutton:大模型在一定程度上分散了我们对智能理解的注意力

在RL China 2025开幕式上,汪军与图灵奖得主Richard Sutton对话。Richard认为大模型缺乏目标和奖励,分散对智能理解的注意力。他强调RL核心是从经验学习,智能原则含梯度下降等,建议将目标解读为“奖励”。

AI科技评论
8

Anthropic发布「AI原生创业公司」手册:涵盖全流程四大核心阶段,一人公司法典来了

Anthropic发布打造AI原生创业公司手册,针对2026年可能性梳理创业四阶段:想法、MVP、上线和规模化,明确各阶段目标、退出标准、失败模式及AI实操练习,涵盖研究、编码、运营等方面。

AI寒武纪
新闻资讯7

数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免

研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。

量子位
推荐文章8

吴恩达来信:AI 技能正在重新定义优秀开发者的标准

吴恩达指出市场对懂 AI 的开发者需求大,应届生失业率上升。面试看重利用 AI 辅助开发等能力,具备这些技能的人效率远超传统开发者,AI 工程正掀起变革,基础与 AI 知识结合造就高效开发者。

DeeplearningAI
8

ART:构建可靠智能体的强化学习新框架

现有AI智能体在真实场景表现不稳定,阻碍其应用走向生产。ART开源强化学习框架诞生,通过分离“前端”与“后端”、兼容OpenAI推理端点等创新化解困境,还给出使用方法,在案例中展现强大效能与经济性。

AI工程化
开源动态8

OpenClaw大考!上海AI Lab InternLM团队WildClawBench 60题,把「龙虾」AI打回原形

上海人工智能实验室InternLM团队推出WildClawBench,含60道高难度任务,在真实OpenClaw环境端到端评测AI Agent。评测涵盖多类别任务,已测14个模型,国产模型表现亮眼,项目开源可复现。

机器之心
算法论文7

AMS最新AI4PDE综述:清华大学冯西桥教授团队白金帅等提出面向计算力学中物理和数据引导的AI框架的未来

本文综述人工智能赋能计算力学框架发展与现状,指出纯数据驱动、物理信息神经网络和算子学习方法虽有潜力,但在鲁棒性等方面有挑战。阐述四个研究方向,为复杂物理系统建模等开辟新途径。

力学与人工智能
新闻资讯8

Transformer亲爹痛斥:当前AI陷死胡同,微调纯属浪费时间!

Sakana AI创始人Llion Jones是Transformer发明者之一,他警告当前Transformer虽成功,但业界或重蹈RNN覆辙,无数微调是浪费时间。他认为现在LLM非通用智能,已转向探索生物学启发的新架构。

新智元