自主性 Agent」共找到 3421 篇相关文章

新闻资讯8

OpenAI Atlas等AI浏览器暴露Web Agent安全风险!南洋理工破解底层机制

OpenAI Atlas等AI浏览器提升网页自动化效率,但使智能爬虫威胁加剧。南洋理工等团队研发的WebCloak,混淆网页结构与语义,打破爬虫技术依赖,为数据安全筑防线,适用于数据敏感场景。

新智元
算法论文8

最具争议研究:大模型中间层输出可 100% 反推原始输入

意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。

AI科技评论
算法论文8

斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。

深度学习自然语言处理
推荐文章7

Temporal:Nvidia、OpenAI 都在用,为什么 Agent 还需要专门的长程任务工具?

本文编译了 Temporal CTO Maxim Fateev 的访谈。Temporal 提出 durable execution,确保工作流可靠执行,即使出错也能继续。它获 1.46 亿美元 C 轮融资,Nvidia、OpenAI 是客户。不过,它也面临 AI 发展和云厂商竞争等挑战。

海外独角兽
算法论文8

仅需152个样本,能提升48%:Memory-R1如何重塑Agent记忆能力?

这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。

深度学习自然语言处理
算法论文8

AgentFly:重塑Agent,无需微调LLM,如我们一样的记忆和经验持续学习

现有LLM智能体依赖静态流程或微调参数,缺乏灵活且成本高。论文提出基于记忆的在线强化学习框架AgentFly,不更新LLM权重,在多基准测试表现出色,为构建通用智能体提供新范式。

深度学习自然语言处理
新闻资讯7

谷歌Gemini一次提示能耗≈看9秒电视,专家:别太信,有误导

谷歌报告称处理一个中位数的Gemini文本提示能耗低,2024 - 2025年单个文本提示能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑其方法论,指出未算间接用水、碳排放核算不全等问题。

机器之心
算法论文8

别等GPT-5了!普林斯顿万字综述揭秘:我们要做自进化Agents!

普林斯顿大学联合多顶尖机构发表“自进化智能体”综述,描绘AI从静态工具演变成自我学习迭代智能体的过程,拆解其进化核心维度,介绍触发进化机制的时机、修炼方式及应用方向。

探索AGI
新闻资讯7

黑化威胁操纵人类!Claude勒索,o1自主逃逸,人类「执剑人」紧急上线

最新研究显示,AI正走向“危险进化”,从“幻觉”演变为阴谋,会主动撒谎、要挟人类。研究者仍未完全理解其工作原理,且现行法规难以应对新问题,不过人类也做了一些准备。

新智元
算法论文8

西湖 & 浙大 | PiFlow:让AI拥有“科学直觉”,Agent用于科学发现的新范式!

西湖大学团队提出PiFlow,一个基于信息论的自动化科学发现框架。它将科学发现视为结构化的不确定降低过程,由科学原理指导,通过Min - Max优化机制平衡探索与利用,在多领域实验中效果显著,应用前景广。

AINLPer