「标准分」共找到 938 篇相关文章
回敬 Codex,Claude Code 推出 /goal 功能,不干完不睡觉
Claude Code随2.1.139版本推出 `/goal` 命令,设定完成条件后可持续工作至目标达成。它与Codex互相借鉴功能,且在设计上采用裁判分离,官方也给出目标制定建议,还带来其他更新。
告别“氛围编程”:基于 Harness 治理和 SDD 的团队级 AI 研发范式演进与实践
本文作者王树新分享团队级AI研发范式演进与实践。指出AI Coding存在自由发挥、效率降低、关键信息丢失问题,分析出码率提升却未提效的原因,引入SDD与Harness解决问题,并介绍全流程自动化实践。
他用AI办了个音乐节,主题:别读博
科研人“馄饨皮茄总”用AI办“不读博音乐节”,系列歌曲在B站获超5000万次播放。他用科研方法论做音乐,选歌、填词、生成音乐都有严格标准。歌曲治愈了科研人,也让他找到与世界的连接。
不要建一千个 Agent:Ramp 如何用一个 Agent 搞定金融自动化
美国企业金融平台 Ramp 估值 320 亿美元,在 The Pragmatic Summit 分享 AI 实战经验。介绍了从“建一堆 Agent”转向“一个 Agent + 一千种技能”架构,Policy Agent 开发过程,定义“正确”标准,建内部 AI 基础设施及内部编码 Agent 情况。
给 OpenClaw 接上钉钉之后,我的龙虾终于把生产力拉满了
作者在深圳做OpenClaw线下Workshop时,发现国内用户用Telegram与它对话不便。后找到接入钉钉的解决方案,介绍了接入原因、配置教程,还分享用其监控AI热点和做竞品分析的使用体验。
击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判
理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。
别再问什么工作被AI取代!Karpathy直指本质:你的工作「可验证」吗?
前特斯拉AI负责人Andrej Karpathy提出,软件1.0自动化能指定的任务,软件2.0自动化能验证的任务。判断任务能否被AI接管,关键看是否满足可重置、可高效试错、可自动奖励三条准则。
成本不到8千美元!新浪微博1.5B小模型超越近万亿参数模型
新浪微博开源的VibeThinker - 1.5B模型,仅15亿参数、训练成本不足8000美元,却在顶级数学竞赛基准击败近万亿参数模型。它采用频谱到信号原则,分两阶段训练,性能出色,成本低且数据无污染。
周末我去泡温泉按模,顺带做了黑客松评委,看到了下一个趋势
作者黄叔参加百度世界与小红书科技打造的黑客松活动,其赛道分解决实际需求和精神需求两类。10 年出生小朋友获一等奖,作品创意惊艳。活动体现开发门槛降低、开发者多样,AI 应用效果涌现。
万象入模 风起琶洲 | 甲子光年
9月23日下午,「第四届琶洲算法大赛大模型前沿技术分论坛暨琶洲模方孵化项目展示」将在广州琶洲举行。届时,亚洲科学院院士等将分享见解,知名投资机构将齐聚,还有企业展示成果、进行辩论,共探AI产业未来。