Agent模型」共找到 9251 篇相关文章

算法论文8

GPT-5.4 仅 11.36%!当大规模工具生态变成迷宫,LLM Agent 还能完成长程规划吗?

PlanBench-XL 来自 UIUC 团队,将 LLM Agent 放入零售 API 世界,评测其长程规划能力。它考虑真实工具环境挑战,含 327 个任务等,发现多数模型规划难、恢复差等问题,并给出改进启示。

深度学习自然语言处理
新闻资讯8

AI制造AI、仓库级Coding到Agent底座:2026奇点智能技术大会首批议题公布

2026 奇点智能技术大会将于 11 月 20 - 21 日在北京举行,同期还有 C++ 及系统软件技术大会。大会公布首批核心议题,涵盖 AI 制造 AI、AI Coding、Agent 基础设施、世界模型、具身智能等前沿技术,多位专家将分享实践经验。

AI科技大本营
产品应用8

小白也能玩转AI视频!即梦Agent模式实测:一句话搞定插画、海报、Vlog

即梦AI新上线Agent模式,用户只需一次输入指令,就能从生图到生视频全搞定。该模式还具备AI小助手功能,能满足多种需求。它基于Seedream 4.0模型,将AI生图降至0门槛,官网现推出免费生图活动。

量子位
新闻资讯7

Cursor已死,Claude当立!Anthropic用L4级Agent,正在“降维打击”整个AI编程赛道。

AI编程领域正上演变革,很多用户从Cursor转向Claude Code。Claude Code成本有优势且具L4级编程能力,其强大还冲击了生态。未来Agentic DevOps是黄金赛道,最终赢家或为有顶尖模型与云服务的玩家。

探索AGI
产品应用8

【一手实测】字节豆包 1.6 + Trae + 火山 MCP + FaaS:AI Agent 开发部署全流程体验!

本文作者实测字节豆包1.6系列模型,用其设计落地页,还借助Trae、火山方舟MCP等实现AI Agent开发部署全流程。测评显示豆包1.6多模态能力强,处理复杂指令效果好,价格实惠,字节AI云原生生态前景佳。

AI进修生
算法论文7

60%情况下,主流大模型没理解风险只是装懂!别被模型的“安全答案”骗了

研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安全对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。

量子位
新闻资讯8

“我可能不再建议学计算机”!图灵奖得主炮轰半个行业,并断言:AI Agent最后全是数据库问题

图灵奖得主 Mike Stonebraker 在访谈中炮轰数据库行业,直言计算机科学未来或不再是增长型行业。他批判 Oracle、Google、AWS 等公司的数据库方案,还指出大模型写 SQL 在真实数据仓库中准确率极低,agentic AI 未来将成数据库问题。

AI前线
新闻资讯7

亚马逊云科技大中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三大技术准备

亚马逊云科技大中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于大模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三大技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。

AI前线
7

华为盘古大模型:被芯片牵制的“千古”模型

华为盘古大模型团队员工自曝内幕,称其受芯片限制,早期算力有限、训练困难。还指出内部存在造假、套壳等问题,如135B V2套壳Qwen 1.5 110B,pangu pro moe 72B套壳qwen 2.5的14b等,导致人才流失。

Agent的潜意识
算法论文8

无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!

论文提出RLSC,让大语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。

深度学习自然语言处理