不可变操作系统」共找到 1448 篇相关文章

开源动态8

大模型首次直接理解代码图:用Agent自动修bug,登顶SWE-Bench开源模型榜单

蚂蚁开源新模型CGM,首创将仓库代码图模态融入大模型,依赖闭源模型和复杂Agent,仅需4步就能快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。

量子位
推荐文章8

深度拆解:为什么通用 Agent 的下一站是 Agentic Browser?

文章指出 2025 年 AI 圈新风暴眼 Agentic Browser 正形成。从 Perplexity 故事讲起,阐述传统系统和浏览器限制通用 AI 发展。厘清通用 Agent、AI 搜索等概念,分析 Agentic Browser 成通用 Agent 下一站的原因,预测 OpenAI 相关产品秋季前发布。

Founder Park
新闻资讯7

苹果炮轰AI推理遭打脸,GitHub大佬神怒怼!复杂任务≠推理能力

苹果发表论文指出推理大模型存在重大缺陷,相关解读在社交平台广泛传播。但GitHub高级工程师Sean Goedecke对论文持保留态度,认为谜题是评估推理能力的好试验场,模型放弃代表无推理能力。

新智元
新闻资讯7

78%主创跳槽!Llama 14名作者只剩3人,Meta最强开源模型团队大溃散引争议

据外媒消息,Meta面临严重人才流失,Llama模型14位核心作者中11位离职,或自立门户或跳槽。同时,Meta大模型研发进度缓慢,旗舰模型屡次延期,一边裁员一边押注AI,且寻求资金支持遇冷。

AI科技大本营
新闻资讯7

ChatGPT 评估员工绩效,评得是真能力吗?

绩效考核季,少管理者用 ChatGPT 生成绩效评语,认为高效。但文章指出,把关键管理工作交 AI 是‘职业肌肉’萎缩,还给出管理场景下 AI 使用清单,网友也对 AI 辅助绩效评估展开热议。

AI科技大本营
算法论文8

新SoTA方法RM-R1:让reward model对评分说出原因!超越GPT4o

过去模型‘黑箱打分’透明、灵活。论文提出ReasRM,经两阶段训练,让奖励模型像人类先思考再打分。它能分任务类型、动态奖励,实验中碾压GPT - 4,小模型逆袭,团队已开源6个模型。

深度学习自然语言处理
开源动态8

微软正式开源UFO²,Windows桌面迈入「AgentOS 时代」

微软研究团队正式开源业内首个深度集成 Windows 操作系统的桌面智能体平台 UFO² AgentOS。它是 UFO 升级版,解决传统智能体问题,在多维度实现突破,经测试表现领先,代码和文档已开源。

机器之心
新闻资讯8

宇树上市:王兴兴的十年非共识|甲子光年

2026年宇树科技成功上市,创始人王兴兴创业十年有诸多“非共识”观点。如高性能机器人意味昂贵,堆数据难带来具身智能,AI强对硬件要求或降低。如今宇树成行业共识,也面临新挑战。

甲子光年
推荐文章8

AI Infra进入自进化时代!清华团队用「AI优化AI」造就国产万亿Token工厂

AI自主优化RSI成新焦点,被视为通往AGI的关键路径。硅谷为此沸腾,中国也落后。清昴智能由清华团队创立,率先打造自进化算力底座,还基于国产算力打造万亿Token工厂,目标是让优化成为持续运行的基础能力。

量子位
开源动态7

AI 剪完整条视频,却没看过一帧:背后是所有 agent 都在用的套路

browser - use团队开源的video - use项目能让Claude自动剪辑视频,且AI看视频帧,靠处理文本完成。这是当前聪明的agent产品通用做法,还给出判断AI agent的三个问题及思路。

AI Reading Hub