「垂类Agent训练」共找到 4598 篇相关文章
Claude/Codex又爆猛烧钱bug,随时准备烧空你的额度,官方躺平不修复。
Claude、Codex这两个用户量大的Agent产品,存在官方不修复的烧钱bug。往会话贴的图片以base64存于session历史,反复重发计费,严重时会话废掉,官方此前也对类似问题不作为。
CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现
谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。
一个CLAUDE.md霸榜GitHub第一!蒸馏自Karpathy,6万码农抄作业
一个名为CLAUDE.md的Markdown配置文件冲爆GitHub,本周新增44,465颗星,总星数61.6k,连续三天Trending日榜第一。它源自Karpathy对LLM编程陷阱的观察,含四条规矩,能约束AI编程Agent。
装上这个Skill后,Claude Code联网能力直接拉满
Web Access 是给 Claude Code 用的 Skill,装上后 Agent 联网能力大幅提升。它解决了 Claude Code 原有联网工具的问题,有联网工具自动选择、CDP 浏览器操作等能力,还介绍了安装方式和设计哲学。
从GLM-4.5到GLM-5,我见证了一个模型从码农晋升为架构师
智谱以匿名方式将GLM - 5放到OpenRouter公测,其表现亮眼。在AI编程从Vibe Coding转向Agentic Engineering的背景下,GLM - 5参数规模提升,成绩优异,实测决策有架构师思路,持久力强,不再只是‘平替’。
幻觉的根源找到了:大模型说谎,是为了讨好你
清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。
英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子
当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。
AI「看见」实验,哈佛颠覆性突破!一副AR眼镜,新手秒变资深专家
哈佛大学刘嘉教授团队研发人机共融智能系统,含APEX和Agentic Lab。前者用于微纳加工,后者用于生命实验。实测显示,它们能实时纠错、自动记录分析、实现技能迁移,让AI与人类在科研制造中深度融合。
具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据
AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。
你敢信?GPT-5的电脑操作水平只比人类低2%了
Agent S3刷新了计算机使用智能体(CUA)在「OSWorld」基准测试的记录,性能达69.9%,接近人类水平。它引入bBoN实现并行扩展,还精简框架、引入原生代码智能体,已开源并发布论文。