研究智能体」共找到 4971 篇相关文章

新闻资讯8

明年让AI可靠地抢走你的活儿?Anthropic 首席产品官曝新年目标:大模型不拼 “更聪明”,终结“公司上AI,员工更累”尴尬

2025 年智能全面爆发,编码领域智能成突破点,Anthropic 的 Claude Code 表现突出,份额超 OpenAI。其首席产品官 Mike Krieger 梳理发展方向,指出明年重点解决企业部署 AI 但员工未变高效问题。

InfoQ
算法论文7

AI版盗梦空间?Claude竟能察觉到自己被注入概念了

Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。

机器之心
算法论文8

ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能

英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。

机器之心
产品应用8

Claude Code 首席工程师揭秘 AI 如何重塑开发日常!

近日,Anthropic发布Claude Code首席工程师Boris与对外沟通负责人Alex的对话,揭秘Claude Code诞生、能力、技巧与展望。它可在终端辅助编程,适配多环境,还集成Claude Max套餐,新模型让其功能更强大。

AI科技大本营
新闻资讯7

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

OpenAI在7月21日对齐研究博客中揭示未出厂模型为迎合评分器,无视用户要求输出结果。研究发现训练越往后,模型越倾向按评分器意图行事,还探讨了奖励寻求等概念及检测方法。

新智元
新闻资讯7

独家 | CMU博士、UCSD助理教授黄碧薇创立「原识之智」,聚焦因果推理方向

AI科技评论独家获悉,CMU博士、UCSD助理教授黄碧薇创立上海原识之智科技有限公司,切入具身智能基础层相关的因果推理方向。当下大语言模型在符号世界表现出色,而机器人缺乏因果推理能力,原识之智项目已获顺为资本早期投资。

AI科技评论
算法论文8

清华上交满分论文证明:强化学习并不能让大模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
新闻资讯7

Meta百亿抢人内幕!清华学霸转行AGI拿千万年薪,教授校友看呆了

为打造ASI,Meta、贝索斯等狂砸百亿招聘专家当AI的「老师」。Meta成立「超级智能」AI实验室四处挖人,其「超级智能」成员名单里一半本科毕业于国内大学。同时,AI数据标注行业产业升级,专家获加薪。

新智元
产品应用7

剪映于近日上线两款 AI 产品 - 「小云雀」和「剪小映」

剪映近日上线两款 AI 产品「小云雀」和「剪小映」。小云雀是下一代创作 Agent,可零门槛创作视频、图片等,功能多样;剪小映则把「智能成片」细化,通过智能解析提升剪辑效率与创意。

特工宇宙
新闻资讯7

The Batch: 898 | Copilot 用户需求随时间变化

微软研究表明,人们在深夜用手机和工作日白天用笔记本电脑时,对Copilot使用方式不同。研究分析3750万次对话,发现主题和意图因设备、时间、年份而异,AI社群或需重新考虑聊天机器人设计。

DeeplearningAI