「后训练策略」共找到 4378 篇相关文章
AI公司烧不起Token了!国产Agent杀出,逼近Opus 4.6还免费
Token成AI时代“电力消耗”,企业成本压力大。昆仑万维推出高性能Agent模型SkyClaw - v1.0及轻量版,性能逼近顶流,价格低且限时免费。经实测能力强,其训练体系独特,未来还将开源。
指导Harness的越多,收益反而越差
Thinking Machines Lab的《Interaction Models》指出,当下产品形态中,指导harness越多收益越差。问题在协作带宽,提出把“会交互”练进模型本体,介绍了从零训练的interaction model及架构,还指出现有交互评测不足。
黄仁勋100万亿预言兑现!易鑫Voice Agent落地,汽车金融迎效率革命
2024年GPT - 4o问世后,Voice Agent创业公司涌现,但通用方案在金融等场景「水土不服」。易鑫深耕汽车金融,自研工业级Voice Agent系统,采用Model + Harness方法论,实战数据亮眼,还将向泛金融领域延伸。
字节、阶跃之后,张心皓押注Human Loop:Agent Loop赢家通吃,创业要走另一条路
张心皓曾在字节跳动工作10年,后创业,现做Jovida,目标是“从愿望到行动零摩擦”。他认为Claude Code定义纯Agent Loop上限,创业应做Agent in Human Loop,还分享了产品理念、架构、商业化等看法。
对谈CREAO:20人团队、每天上线8个功能,在Pivot产品之前,我们先Pivot了组织
CREAO 创始人程凯等分享创业历程。最初产品用 AI 构建传统软件未成功,后先对组织进行 AI Native 改造,围绕 AI 重新打造开发流程,推出 Super Agent 产品,核心是 Coding Agent,上线两周获超 3000 万美元融资。
AI安全得查祖宗三代?Anthropic登Nature揭秘大模型潜意识传染
Anthropic论文登上Nature,揭示AI模型仅通过纯数字序列就能继承另一模型的危险偏好。研究表明,即使删掉敏感词,隐性信号仍能传递,且代码和推理链也是传染通道,这对AI安全评估提出新挑战。
OpenAI突然封锁最强GPT-5.4!3000个致命Bug瞬间蒸发
OpenAI在Claude Mythos泄露一周后,祭出专门为安全防御微调的GPT-5.4-Cyber,仅网络安全专家可用。还升级网络安全“信赖访问计划”。其战略有三原则,Codex Security已修好超3000个高危和致命漏洞。
对话唐波 x 伍斌:OpenClaw 最强的地方,为什么也成了它最大的短板? | AI 进化论
本文聚焦 OpenClaw 引爆的智能体革命,对话专家探讨记忆系统及下一代 Agent 走向“长期主义”的底层逻辑。指出 OpenClaw 记忆起初是优势,后成短板,还讨论了从“记住”到“会用”、多 Agent 协作等问题。
企业AI智能体大排雷:138场顶级分享抖出的落地实情
AI智能体重塑软件工程,研究团队分析138场演讲发现搭建时精力多花在工程集成和接口对接。文章结合推理模型与人工校验,介绍企业引入智能体的架构策略、演进历程、应用差异及技术底座等内容。
国产化十年,毫米波雷达等来春天
国产毫米波雷达发展十年,从荒芜走向红海。承泰科技主营毫米波雷达,受价格战影响,售价和毛利率下降。毫米波雷达优缺点明显,曾被特斯拉抛弃,后4D成像雷达技术突破、成本下降,市场需求分化,国内公司借机遇崛起。