「办公任务模式」共找到 2860 篇相关文章
Agent失忆怎么办,Anthropic教你做好工作交接
文章指出AI Agent跨上下文窗口执行长任务时易失败,Anthropic用Opus 4.5实验发现,问题根源是交接差。解决办法是让Agent像人类工程师一样留文档、进度和测试,拆分流程,严格规范,提升测试覆盖率。
AI 浏览器压根不可能成为新的操作系统
近期AI浏览器成大模型主战场,营销中模糊Browser和OS边界。文章指出‘AI Browser = OS’不成立,分析原因,还提出定义为Agent操作层更合适,未来或走向能力优先、标准互通的‘通用容器’模式。
他们想用AI发现不存在的物理学,然后用它去半人马座
美国初创公司 Physical Superintelligence(PSI),计划用 AI 加速物理发现。其核心平台 Emmy 能拆解研究问题。商业应用从 AI 数据中心切入,还参与费米探索者星际探测任务,目标平衡学术与商业。
Anthropic 发布 Computer Use 最佳实践
Anthropic发布Computer Use开发者最佳实践,涵盖截图处理、模型选择、上下文管理等多方面。如缩小截图提升点击准确率,不同模型各有所长,还给出应对小目标、提示注入等问题的策略及教学、顾问模式。
将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了
Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。
Claude code让程序员消失,Anthropic却说用AI编程会让你变傻
Anthropic科学家实验发现,新手过度依赖AI编程,概念理解、代码阅读和调试能力显著退化,效率未提升。研究识别六种AI使用模式,指出主动思考才是技能形成途径,应保留人脑训练的“摩擦力”。
AI 会取代你的工作吗?Anthropic 用 200 万对话告诉你答案
Anthropic发布Economic Index第四期报告,分析200万次Claude对话,提出“经济原语”框架。发现AI对高学历任务加速效果更好但成功率低,还揭示Claude.ai与API差异,引入“有效AI覆盖率”等。
突发!Cognition宣布收购Windsurf:看上的还是AI人才
Cognition宣布收购Windsurf,旨在构建软件工程未来。此次是全面整合,获其核心产品、IP、强劲业务、庞大用户基础及顶尖人才。Cognition还提供员工保障方案,战略协同有望变革软件开发模式。
开源即屠榜!UniME多模态框架登顶MMEB全球训练榜,刷新多项SOTA纪录
格灵深瞳等团队联合发布通用多模态嵌入新框架UniME,刷新MMEB训练榜纪录。它是两阶段框架,经文本判别知识蒸馏和困难负样本增强指令微调,在多任务达SOTA,项目已开源。
把X接进Codex:AI终于有了自己的信息雷达
作者将X接入Codex,通过官方MCP直接调用X API获取数据。这让AI OS有稳定实时信号输入,成为主动工作系统。介绍接入步骤、费用及使用建议,如先跑小任务。