「自动模式」共找到 1444 篇相关文章
“这个怎么组装?”一句无害的问题,如何让AI产生危险输出
Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。
Kimi K2.6背后的Agent Database:Agent-native 时代的数据 Infra 竞争,跟过去 30 年有何不同
TiDB Cloud 成 Kimi K2.6 供应商,为其 Agent 建站服务提供支持。Kimi K2.6 由 Agent 完成在线应用构建,与其他 AI 建站应用不同,它全托管且用户无需技术背景。该合作解决了成本和基础设施难题,展现了 Agent-native 时代数据 Infra 竞争的新特点。
Codex跑了22小时,真赚16.88美元:奥特曼预言的「AI打工人」来了
开发者Chris让Codex按「去GitHub上赚5美元」指令运行22小时,几天后获16.88美元。虽流程细节缺验证,但显示Codex在特定条件有「找漏洞→提PR→跟进审查」能力,不过距真正自主赚钱仍有距离。
告别单打独斗!ClawTeam-OpenClaw 一键 spawn 整个 AI 开发团队
ClawTeam-OpenClaw 是多代理协调框架 OpenClaw 深度适配版,让 AI 代理自动组队协作。它有一键 spawn 团队、智能任务依赖管理等功能,在科研、开发、投资分析场景优势明显,介绍了使用方法和项目地址。
ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像在统一架构中共同演化
NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像在统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或超 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。
我们做了比你更懂 Java 的 AI-Agent -- Arthas Agent
Arthas是强大的Java诊断工具,但门槛高。Arthas Agent可将自然语言意图转化为Arthas操作,输出诊断报告。它技能优先、安全优先、循证闭环,通过多案例展示其诊断优势,还介绍使用方法和提效建议。
自动化评测的九九归一——评测agent
本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。
MotlBot作者被Claude刁难后:MiniMax M2.1是最优秀的开源模型
Moltbot热度不减,开发者挖掘其实用价值,阿里云、腾讯云上线相关云服务。Moltbot作者Peter接受采访,分享项目起源、开发思路等,认为MiniMax M2.1是优秀开源模型,还探讨了智能体发展及项目后续规划。
5年博士1年读完,20分钟干完48小时教授工作!这个工具在硅谷火了
新智元报道,Claude Code正重新定义编程。顶级开发者用它写代码,零基础小白10分钟做出App,教授20分钟完成48小时工作量。它理解项目上下文,自动设计、生成、测试代码,普通人用自然语言提需求即可。
端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统
北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。