「自主代理」共找到 724 篇相关文章
Claude Code 的创始人揭秘工作流程:开 5 个智能体“玩编程游戏”,不看的程序员就落后了?
Anthropic公司Claude Code创始人Boris Cherny在社交平台分享工作流程,引发行业关注。他并行运行5个Claude智能体编程,用最大最慢模型Opus 4.5,还解决AI“健忘症”,实现重复性任务自动化。
The Batch: 893 | 从预测到执行
2026 年 AI 研究应认识到能预测的模型不等同于能行动的系统。过去十年在被动预测和生成建模成就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。
Transformer学不会多位数乘法?MIT和哈佛的研究指出了一个简单漏洞
MIT、哈佛和谷歌DeepMind团队实验发现,Transformer做4位数乘法有软肋。用‘隐式思维链’(ICoT)训练的模型准确率达100%,传统方法仅1%。研究揭示了问题根源,还给出修复方案,但也引发诸多质疑。
生图效果媲美GPT-4o,一键搞定各类视觉生成任务丨港科广&字节全新框架
港科大(广州)和字节联合推出开源框架ComfyMind,它是通用视觉生成框架,能统一处理主流视觉生成任务。其性能超现有开源方法,媲美GPT - 4o - Image,还介绍了架构、接口等及性能评估情况。
史诗时刻!AlphaGo神之一手突现,谷歌AI颠覆科研极限?
谷歌DeepMind推出AlphaEvolve,它取得多项数学成果,如改进4x4矩阵乘法、推进六边形填充问题研究等。它能自我进化,还可优化谷歌计算基础设施,预示人类与AI强大协作循环的未来。
ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」
现有第一人称视频助手难以自主判断何时介入服务用户。大连理工大学等团队提出Vinci2,含评测基准EgoServe和智能体EgoMemo。它已被ECCV 2026接收,代码和标注均开源。
Dario访谈首曝:Mythos被称为「超级武器」
Bloomberg主持人与Anthropic CEO Dario Amodei进行69分钟访谈。谈及Mythos模型强大危险不敢发布,还探讨AI递归自改进、文明崩塌概率、白领工作消失等问题,Dario坦率面对技术矛盾。
Fable 5榜单第一靠作弊?代码泄露,模型真实身份曝光
黑客泄露Claude Fable 5长达12万字符的系统提示词,揭示它并非大模型,而是伪装成LLM的完整Agent系统。这颠覆了对AI模型的认知,也让Anthropic陷入舆论漩涡,还暴露了其计费黑幕。
DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude
DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。
Tank OS:红帽首席工程师把OpenClaw打包成可启动的Linux设备
红帽首席软件工程师Sally O'Malley在GitHub发布开源工具Tank OS,它用bootc技术将Fedora Linux和OpenClaw打包成可启动容器镜像。该工具解决OpenClaw配置安全问题,适合企业环境,虽非面向小白,但对企业IT重要。