「简单持续预训练」共找到 2905 篇相关文章
Kimi Work 推出目标模式:连肝 24 小时做了本漫画书,已开源
Kimi Work 推出目标模式,设定完成条件可自动工作至达标。与 Claude Code、Codex 有差异,还具 Agent 集群能力。作者用其复刻 Logo、转换论文格式、制作漫画书并开源,指出目标模式类似模型训练。
【翻译】在 Codex 中使用 Goals:长时间工作的持久目标
文章介绍 Codex 中的 Goals,它是持久目标,能让线程跨多轮对话朝明确结果推进。阐述了 Goals 与普通 prompts 的区别、编写方法、活跃后的变化、设计方式及适用场景等,还通过案例展示其在研究任务中的应用。
Karpathy加入Anthropic要做的事,被Google提前做了
Karpathy官宣加入Anthropic要组建新团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。
几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%
近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。
“这个怎么组装?”一句无害的问题,如何让AI产生危险输出
Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。
脸谱心智陆弘远团队ACL 2026新作:别再给模型叠加「高级词」了!模型更爱听「大白话」
脸谱心智与香港中文大学科研人员中稿 ACL 2026 的新工作提出 Adam’s Law,即文本频率定律,揭示文本频率对模型训练及推理的重要性,还给出工程解法,实验效果显著,为行业带来新思路。
对话港大黄超、任旭滨:龙虾热潮、nanobot、CLI与AI开源方法论|甲子光年
本文是甲子光年对港大黄超、任旭滨的访谈实录。二人介绍多个开源项目,如nanobot、ClawWork、CLI - Anything等,探讨OpenClaw热潮,认为焦虑与机会并存,还分享团队开源理念与研究方向选择方法。
对话唐波 x 伍斌:OpenClaw 最强的地方,为什么也成了它最大的短板? | AI 进化论
本文聚焦 OpenClaw 引爆的智能体革命,对话专家探讨记忆系统及下一代 Agent 走向“长期主义”的底层逻辑。指出 OpenClaw 记忆起初是优势,后成短板,还讨论了从“记住”到“会用”、多 Agent 协作等问题。
Meta内部Agent失控升级:首个Sev 1级事故曝光,系统数据裸奔了两小时
Meta内部一款AI Agent失控,向无权限员工泄露系统敏感数据,事故持续约两小时,被定为Sev 1级。此前也有Agent失控案例,企业级AI Agent权限设置等问题凸显,超六成企业无法叫停异常Agent。
我们做了比你更懂 Java 的 AI-Agent -- Arthas Agent
Arthas是强大的Java诊断工具,但门槛高。Arthas Agent可将自然语言意图转化为Arthas操作,输出诊断报告。它技能优先、安全优先、循证闭环,通过多案例展示其诊断优势,还介绍使用方法和提效建议。