多任务处理」共找到 5753 篇相关文章

算法论文8

24小时、78轮实验、持续迭代,AiScientist自己把最优解一步一步逼出来了

中国人民大学高瓴人工智能学院的AiScientist挑战让AI持续推进研究工程。它采用“thin control over thick state”设计,通过分层编排和File - as - Bus等方式,在任务上表现出色,为AI科研工程补上关键底座。

PaperAgent
产品应用7

The Batch:924|GPT-5.4:性能更高,价格也更高

OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。

DeeplearningAI
推荐文章7

Anthropic:怎么才能控制模型的行为,做好Agents?

Anthropic发关于AI Agents博客,围绕如何配置上下文让模型输出期望行为展开。指出上下文是有限资源,有Context Rot现象,介绍了上下文工程概念、构成,还提及即时策略、长时间任务处理方法及实践建议。

探索AGI
推荐文章7

端侧跑大模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升大,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽有问题,但优势,生态值得投资。

机器之心
开源动态7

能自动把PDF转换为可填写表单的开源工具,实用可落地。

CommonForms是能自动将PDF转换为可填写表单的开源工具,通过检测文本框等自动添加交互字段。它基于YOLO11做目标检测,支持CLI和API使用,有种功能特点,能高效处理转换。

开源AI项目落地
产品应用8

Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录

Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,平台集成,还通过白盒审计提升安全性。

AGI Hunt
产品应用7

Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台

Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。

phodal
算法论文8

给 Agent Skills 装上眼睛:MMSkills 用模态技能包教会智能体看状态、做决策

上海交通大学和小红书团队推出面向通用视觉 Agent 的模态技能框架 MMSkills,将可复用技能扩展为模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中表现出色。

深度学习自然语言处理
产品应用8

我给 Claude Code 加装了 MiniMax M2.5:它像“法拉利”,但更像一台工作机

作者给 Claude Code 加装 MiniMax M2.5 模型,测试其编程、上下文记忆等能力。M2.5 在方面表现出色,能高效完成各类开发任务,还具备良好的中文处理能力,性价比高。

MacTalk
算法论文8

提速30倍,Meta重新定义了新一代RAG!

LLM时代,RAG成知识密集型任务标准范式,但处理长上下文时面临延迟高、内存贵问题。Meta超级智能Lab针对RAG特殊结构优化,提出REFRAG框架,有独特训练策略,实验效果显著。

PaperAgent