「智能体任务」共找到 4899 篇相关文章
奥特曼宣判Transformer死刑! AGI两年内降临,下一代架构已在路上
奥特曼在访谈中表示未来将有全新底层架构取代Transformer,还称AGI两年内降临,编程智能体是下一个引爆点。他回忆OpenAI草创期,还给出诸多判断,“后Transformer”竞赛也已打响。
苹果推出 Ferret-UI Lite:一款用于查看和控制 UI 的端侧 AI 模型
苹果推出 30 亿参数的 Ferret-UI Lite 端侧 AI 模型,可解析屏幕图像、与应用交互。现有 GUI 智能体方法存在建模复杂等问题,Ferret-UI Lite 性能有竞争力,训练采用两阶段流程,还给出应用建议。
程序员不许写代码!OpenAI硬核实验:3人指挥AI,5个月造出百万行
OpenAI官博曝光内部实验,3人团队利用Codex智能体5个月造出百万行代码产品,人类不写代码,精力放于规划规则。此实验颠覆软件工程定义,宣告手工代码时代终结,也重塑程序员岗位。
谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了
全球人工智能竞争升温,谷歌与 OpenAI 同日发布更新。谷歌推出全新 Gemini Deep Research 版本及嵌入式研究智能体 API,OpenAI 发布 GPT - 5.2。谷歌新工具能力提升,测试成绩佳,引发网友不同看法,二者竞争激烈。
所谓“氛围编程”,不过是“技术债”的新马甲
本文编译自 Steve Krouse 演讲与博客,指出‘氛围编程’代码即遗留代码、‘技术债’,编程核心是理论构建。还认为工具优于智能体,代码是描述软件的正确媒介,人类大脑在编程中始终是核心。
AI的记忆问题解决了!最强记忆基准99%的准确率
Supermemory团队构建的实验性AI智能体流程,在LongMemEval基准测试中达近99%准确率。其技术摆脱传统限制,以新方式处理信息。ASMR创新数据摄取和检索管道,有两种回答流程,团队计划开源代码。
Flash-Searcher:Web Agent的并行革命
当下Web智能体用顺序执行链解决复杂任务存在执行和信息利用率低的问题。为此提出Flash - Searcher,以DAG并行执行机制为核心,提升执行吞吐与速度,在多基准上表现优,代码已开源。
微调已死?Agentic上下文工程登场,无需微调实现模型进化
斯坦福大学等团队提出 Agentic Context Engineering 技术,让语言模型无需微调自我提升。它将上下文视为作战手册,引入三种协作角色与三项创新,实验显示其在两类任务上表现优异,成本和延迟显著下降。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
QCon 北京 2026 启动|Agentic AI 时代的软件工程重塑
QCon北京2026启动,核心主线为「Agentic AI时代的软件工程重塑」。过去大家关注‘AI能做什么’,如今转向其在生产系统的稳定运行等,智能体成新方向,大会将从六维度探索。