「AI浏览器自动化」共找到 9937 篇相关文章
不止修bug:Agentic Coding评测走向复杂feature交付新阶段
中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。
开源版Cowork爆火,逼得Anthropic下放Cowork
2026年1月,AI巨头Anthropic与开源项目Openwork展开定价权战争。开发者因嫌Claude Cowork贵,两天开发出Openwork。它免费、更快、更安全,迫使Anthropic将Cowork功能从$100档位下放至$20档位。
硅谷真实「无间道」!OpenAI前CTO怒斩泄密联创,奥特曼打包收了
硅谷AI圈上演“无间道”,Thinking Machines Lab掌门人Mira Murati开除被指泄密的CTO Barret Zoph,OpenAI迅速接人。这重创了TML,Mira宣布“PyTorch之父”Soumith Chintala出任新CTO。
ChatGPT群聊来了,Slack和钉钉要哭了
ChatGPT上线群聊功能,目前处于试点阶段。它与Slack、钉钉不同,是在AI里长出协同。有潜水和主动两种互动模式,还将加入多种功能,或改变协作赛道格局。
内存涨价赛过黄金,这些存储公司业绩、股价两开花
近期存储价格年内持续飙涨,幅度超黄金。DDR4现货价较年初暴涨200%,部分经销商溢价出售。存储产品涨价源于AI应用扩张,供不应求热潮蔓延至封测端。多家存储公司业绩和股价两开花。
刚刚,OpenAI股改完成,非营利主体更名
OpenAI宣布完成资本结构重组,上市道路铺平,软银225亿美元投资将到账。重组后非营利主体更名OpenAI Foundation,掌控营利实体26%股份。基金会将在健康和AI弹性技术上投250亿美元。
Meta提出StepWiser,让模型学会“反思”自己的推理过程
Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。
刚刚,Anthropic推出Claude Chrome插件,仅限1000人
Anthropic发布Claude for Chrome扩展,让Claude能在浏览器操作,仅向1000名Max计划用户开放预览。虽功能强大,但面临提示注入攻击风险。不过Anthropic有多层防护,降低了攻击成功率,并给出用户安全建议。
The Batch: 869 | 编码助手的训练数据
研究人员开发自动生成编码助手训练数据的流程。斯坦福等高校及阿里团队提出 SWE - smith 方法,从 128 个 Python 仓库入手合成漏洞、验证并生成修复样本,成果免费开放,有望改进 AI 辅助编程模型。
突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法
AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。