多阶段训练」共找到 5953 篇相关文章

新闻资讯7

AI“读书”合法了:美法院最新裁定,无需作者同意,已购书籍可用于训练AI

美国法院裁决允许Claude背后公司Anthropic,在未经作者许可下用合法购买的已出版书籍训练AI,参考“合理使用”原则,认为属“转化性使用”。此前也有类似AI版权诉讼案例。

量子位
新闻资讯7

Anthropic智能体大会:Agent也会精神分裂,我们发现了Agent协作的本质解法。

Anthropic开发者大会聚焦Agent,分享智能体实战经验。Omni的Blobby出现‘精神分裂’问题,根源是内外层Agent能力认知断裂,修复方案是将工具上提。Anthropic团队则通过协商签订协议解决角色定义不一致问题。

探索AGI
新闻资讯7

AI训练初创公司Mercor,年运收入4.5亿美元,冲击100亿美元估值

AI训练初创公司Mercor正洽谈C轮融资,目标估值100亿美元或更高。它为OpenAI等对接专家,还提供数据标注服务,年化运营收入近4.5亿美元,但也面临Surge AI等对手竞争,OpenAI新平台或带来新威胁。

AIGC开放社区
新闻资讯7

取消AI考核、零裁员!股价暴跌82%后,邻国走出了一条反硅谷之路

邻国曾是 AI 转型标杆,股价一度暴涨,但近一年暴跌 80%。创始人 Luis von Ahn 表示不裁员,曾将 AI 应用纳入考核又取消,分享员工用 AI 开发课程案例,还谈了 AI 局限、对行业影响及公司应对策略。

AI前线
算法论文8

在AI社会抓「内鬼」?上海AI Lab推出首个智能体极端事件解释框架

2023年起智能体系统成人类社会数字镜像,但复杂系统会自发涌现极端事件。上海AI Lab等团队推出解释框架,用沙普利值拆解风险,发现极端事件五大演化规律,还能提前防控风险。

机器之心
算法论文8

ICLR 2026 Oral | 告别步去噪!清华团队推出MVP,实现机器人动作单步极速生成

清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在任务测试中表现出色。

机器之心
算法论文8

GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在种任务中表现良好。

机器之心
算法论文7

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识智能体系统中的Orchestrator

来自南京大学NLP实验室的ICML 2026论文指出,当前主流智能体架构中,系统失败常源于负责全局调度的Orchestrator失去对任务的掌控。论文提出相关框架和方法对其进行分析与评估。

机器之心
算法论文8

AI for Science开年新突破:中科大实现尺度结构逆向设计128倍加速,登上Nature子刊

中国科学技术大学联合所院校,在功能双连通尺度结构逆向设计领域取得突破,成果发表于Nature Communications。研究解决核心瓶颈,提供新范式,在方面展现优势与潜力。

机器之心
开源动态8

开源RAG又添新军!港大开源模态RAG神器,文档格式统一解析、知识图谱索引与混合检索!

在AI信息检索领域,传统RAG系统难处理复杂文档。港大数据智能实验室开源RAG - Anything,可提供端到端解决方案,能格式解析、构建知识图谱和混合检索,优势显著。

开源星探