「智能体任务」共找到 4885 篇相关文章
从豆包手机谈起:端侧智能的愿景与路线图
近日,字节跳动发布豆包手机助手,标志大模型应用从‘Chat’迈向‘Action’。文章解析其关键技术,指出虽具实用价值,但端侧智能体面临安全、自主任务、个性化服务等挑战,还展望了手机助手与端侧智能体的未来发展。
面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。
当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。
AI操作有了“紧急刹车”!通义&自动化所AI决策诊断模型,GUI智能体纠错正确率SOTA
阿里通义实验室与中科院自动化所推出GUI - Critic - R1模型,能在GUI智能体操作执行前诊断决策,避免错误。介绍了其动机、方法、数据集及实验,证明该模型在生成判断和提建议方面有效。
不训练,解锁Agentic智能!微软:只需给LLM一台电脑
人大、MSR、清华的LLM - in - Sandbox开启「通用代理智能」新范式,把大模型放进“虚拟机”,让其在6大任务上成绩全线暴涨,零额外训练解锁“通用代理智能”,还介绍了相关实验、优化及效率情况。
168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案
Cursor创始人公布实验结果,让数百个AI智能体跑一周,从零造出可用Web浏览器,产出超300万行代码,项目源码已公开。此次实验靠GPT - 5.2 - Codex,还设计了智能体协作架构,引发业界讨论。
开源“裸考”真实世界,国产具身智能基座模型拿下全球第二!
国产具身智能基座模型WALL - OSS在RoboChallenge真机评测榜单获全球第二,多个单任务排第一。它是开源模型,开源程度彻底。还介绍其技术突破及团队情况,强调开源对具身智能发展意义重大。
Claude Sonnet 5:更强,但更贵,每任务成本反超Opus 4.8
Anthropic 发布的 Claude Sonnet 5 智能指数追平 GPT - 5.5,但每任务成本比 Opus 4.8 贵 15%。它在知识工作类任务表现佳,推出促销价,不过促销后成本待察。评估迁移时需算 token 消耗。
AI 产品范式探讨:非线性思维、多 Agent 协作才是复杂任务的更优解
本文探讨AI产品范式,指出当前大模型产品设计多将其视为‘万能单兵专家’,但复杂任务下效果不佳。提出群体智能、非线性思维等观点,阐述人机协作方向,介绍新范式及AI产品商业化核心是信任。
Cursor押注云端Agent!CEO 放话:审核AI代码是开发者最核心竞争力
Cursor CEO 称 AI 编程进入第三时代,智能体可少人工介入完成复杂任务,开发者角色转变。Cursor 团队超三分之一 PR 由云端智能体生成,不过这引发了开发者对代码审查、工作流、安全等问题的讨论。
专治智能体盲跑!微软发布AI Agent 5大可观测性,打通任督二脉
今天凌晨微软官网发布AI Agent 5大可观测性最佳实践,解决智能体盲跑等难题。介绍了智能体可观测性概念和好处,展示5个应用案例,还阐述5大实践,如选模型、持续评估、集成CI/CD等。