「语言智能体」共找到 4289 篇相关文章
YC点名创业方向:AI欺诈猎手,可能干掉整个反欺诈行业!
2026年春,YC发布的RFC清单中,‘政府欺诈猎手基础设施’引发关注。传统反欺诈存在‘非对称竞争’,而智能体技术为防守方带来翻盘机会。构建AI原生业务模型,可让防守方获结构性优势,但要解决安全与合规问题。
分享两篇Claude Skills最新论文,有3个核心结论
文章分享两篇Claude Skills最新论文,总结出技能安全漏洞、技能数量与准确率关系等结论。还探讨单智能体技能系统能否取代多智能体,通过实验验证其效率优势,并提出解决技能选择过载的方案,也对Agent Skills做了安全分析。
缔造OpenAI的秘密,竟只有一个词!新智元十年峰会圆桌,七位大咖激辩
新智元十周年圆桌论坛上,七位嘉宾探讨通往AGI与ASI的关键问题,如智能核心、AI能效、游戏与AI关系等。他们认为AI发展超预期,语言是智能核心,实现ASI关键在能耗,还谈及芯片与人脑差距、物理世界发展慢等话题。
RL在Agentic Reasoning中的作用:拨开迷雾,看清本质
近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。
老黄杀入OpenClaw战场!最强开源「龙虾」模型直逼Opus 4.6
英伟达推出新一代开源模型Nemotron 3 Super,专为大规模AI智能体打造,有1200亿参数,推理快、吞吐量高,性能直逼Claude Opus 4.6等。它解决了Agent应用的难题,还开源了相关数据和训练方法。此外,英伟达还在打造NemoClaw开源AI智能体平台。
10万引普林斯顿刘壮最新访谈:架构没那么重要,数据才是王道
普林斯顿大学助理教授刘壮在访谈中指出,架构没那么重要,数据、规模和记忆才是决定AI成败的关键。他认为ConvNet和Transformer性能差异源于训练细节;当前数据集远不够多样;大语言模型有语言空间的世界模型,但视觉空间的还缺失;记忆是瓶颈,智能体只是权宜之计;AI目前还替代不了研究生。
具身智能需要从ImageNet做起吗?
文章探讨具身智能发展,分析其爆发原因,如人类无法完全数字化等。指出几种失败模式,还讨论输入信号、触觉、学习方法等决策点,认为具身智能的‘ImageNet’时刻是伪命题,不同智能领域可能殊途同归。
The Batch:827 | Claude 4 推动代码生成能力再升级
Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。
突发!OpenAI大神姚顺雨,任腾讯首席AI科学家
OpenAI科学家姚顺雨入职腾讯,任首席AI科学家,兼AI Infra部、大语言模型部负责人。他是清华姚班学霸,研究智能体成果多,还曾提出AI进入‘下半场’,评测将更重要的观点。
成本降九成,准确率100%!MIT反常识架构挑战硅谷信仰
慕尼黑工业大学等研究者指出企业AI落地问题源于数据乱。RUBICON架构用AQL查询语言,把操作权交用户,让LLM在精确范围工作。测试中它准确率100%,成本低,优于现有智能体AI方案。