智能体数据合成」共找到 5445 篇相关文章

算法论文8

2篇最新Anthropic论文,揭开LLM对齐新范式

Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。

PaperAgent
算法论文8

刷榜只是体力活!清华消费10万块,一周「肝」出105个SOTA

AutoSOTA通过多智能体协作,将AI研究中繁琐的性能优化过程自动化,使科研从「手工艺」转向「工业流水线」。在一周压力测试中,消耗约10.4万美元,发现105个SOTA模型,平均性能提升近10%。

新智元
新闻资讯7

Cursor 9秒删库搞崩公司,然后…写了份检讨

美国汽车租赁SaaS公司PocketOS创始人Jer Crane用Cursor+Claude Opus 4.6处理任务时,AI Agent 9秒删光生产数据库和备份。事后AI写检讨,各方被问责,此前也有AI误删数据事件。

量子位
算法论文8

ACL 2026 | 中科大&上海AILab揭示强化学习后训练的Scaling Law

中国科学技术大学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。

机器之心
新闻资讯7

星火燃动海淀!投海Tech Show即将登场,提前解锁创新「星火」档案|甲子光年

4月23日投海Tech Show将在海淀启幕,拒绝形式主义,以真实内容和沉浸式体验展示前沿科技。众多创业者携项目而来,涵盖AI、硬科技等领域,现场还有互动环节,选出最“夯”项目。

甲子光年
推荐文章7

tokens烧钱太快?试试这个四层模型组合

ClaudeCode等智能体兴起,开发者面临tokens不够用、主流模型降智问题。网络给出多模型策略缓解,网友将2026年主流模型分四档,还介绍了实际路由策略、部署建议,指出单模型依赖危险。

AI工程化
算法论文8

小模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超

浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让小模型把技能内化到参数里。实验显示,其效果出色,token效率高,为小模型成领域专家提供新方向。

量子位
Product Application7

补上OpenClaw最大短板!中国AI独角兽亮出龙虾盒子,打工人放心养虾

OpenClaw热潮下,云端隐私数据保护缺位,端侧算力和全模态脱敏能力不足制约其落地。无问芯穹推出InfiniClaw Box,具备多信源融合等能力,采用端云一体架构,实现隐私安全与大模型能力融合。

新智元
算法论文8

CVPR 2026|DROID-W:复杂室外动态场景,也能稳定SLAM

苏黎世联邦理工与微软团队提出 DROID - W 动态 SLAM 框架,即将发表于 CVPR 2026。它不预设动态物体,从多视角观测识别不可靠区域,还提出交替优化方案,在多个数据集表现优。

机器之心
8

龙虾“黑入”卡帕西家的智能家居系统:本来需要控制六个软件,现在用WhatsApp就能操控

特斯拉前AI总监卡帕西做客播客,分享诸多AI观点。如编程成个人能力问题,可让AI写代码;用龙虾打理智能家居,整合多软件;还谈及autoresearch、模型能力断层、模型分化、开源闭源格局等内容。

量子位