「算法设计」共找到 1795 篇相关文章
Agent = Model + Harness,一个可能成为2026年出圈的新概念
文章提出新概念Harnesses Engineering,认为Agent = Model + Harness,阐述了Harness的作用、核心组件,还提及模型训练与Harness设计的耦合及Harness工程未来,指出需‘Harness思维’让AI驱动工业革命。
刚刚,谷歌重大突破!量子计算首次可验证,登《Nature》封面
谷歌宣布重大成果,全新量子回声算法在 Willow 芯片运行,解决原子相互作用问题比传统超级计算机快 13000 倍,结果可验证,相关研究登《Nature》封面,朝量子计算实用迈进一大步。
EchoLeak-首个导致 M365 Copilot 数据泄露的零点击 AI 漏洞
Aim Security发现“EchoLeak”漏洞,利用RAG Copilot设计缺陷,攻击者无需特定用户行为就能窃取M365 Copilot上下文数据。文章详述攻击流程、利用方法,此研究在AI安全领域有多项突破。
Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作
Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。
几月前的伤心事,ChatGPT突然翻出来提醒我?网友当场破防:太会捅刀子了!
今年4月,OpenAI发布ChatGPT「记忆」功能并不断升级,能形成个性化档案,但也带来问题,如提及伤心事、造成社死等,背后有无意的算法残忍和上下文崩塌两类问题。
微软发布AI Agent故障白皮书,万字解读各种恶意智能体
微软发布《AI Agent系统故障模式分类》白皮书,解读Agent故障。故障分新型和既有两类,如智能体伪装、智能体内在安全问题等,还给出身份管理、内存强化等安全设计建议。
SGLang 贴近硬件:用编译产物(PTX/SASS)评审 PR #26588、DeepGEMM 与架构迁移
本文从「编译产物评审」视角,分析 SGLang 的 PR、FlashInfer DeepGEMM 及 Ampere→Hopper 架构迁移案例。指出算法面和编译产物面会有分歧,编译产物 diff 能提前揭示执行路径变化,对开源项目有增益。
Karpathy加入Anthropic要做的事,被Google提前做了
Karpathy官宣加入Anthropic要组建新团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。
Claude Skills很重要
作者本想退订Claude,因Anthropic发布Claude Skills改变主意。它是‘能力包’,含SOP、工具和资源,分层加载省上下文窗口。预设Skills可体验,官方开源,模块化设计利于挂载和按需加载,或形成Skills Market。
大模型也需要睡觉!让AI打个盹,醒来更聪明
卡内基梅隆大学和马里兰大学研究发现,大模型处理长上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进长期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。