多阶段训练」共找到 5975 篇相关文章

新闻资讯8

让AI学会潜意识推理,Sapient发布类脑模型HRM

新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在项高难度推理任务上超越大模型。它绕过大模型推理困境,借鉴大脑机制,训练效率高,开源后GitHub星标突破10.3k。

AIGC开放社区
开源动态8

Github 4.1k star,SuperSonic AI×BI 大厂震撼开源

SuperSonic 是腾讯音乐开源的下一代 AI+BI 平台,融合 Chat BI 与 Headless BI 两种范式。它解决了传统 BI 工具复杂、数据口径不统一等痛点,有丰富功能和技术优势,适用于业务场景,开源优势明显。

小华同学ai
新闻资讯8

微软发布5大AI Agent模式:一键解锁AI员工,打造智能体工厂

今天凌晨微软官网发布5种常用Agent模式助用户开发自动化AI员工。智能体比传统自动化工具更具优势,能推理协作等。各模式都有应用案例,且Azure AI Foundry支持Agent模式开发。

AIGC开放社区
新闻资讯7

OpenAI o3-pro模型发布,但不能聊天

当地时间6月10日,OpenAI o3 - pro模型发布,ChatGPT Pro用户可通过API使用。它是o3子版本,在领域表现出色,但响应慢,适用于对可靠性要求高的难题。目前临时聊天功能停用,不支持图像生成和Canvas。

AI前线
新闻资讯7

AI Agent平台Clay获红杉资本投资,估值15亿美元

AI Agent平台Clay获红杉资本领投的员工股票回购要约,估值15亿美元。该平台过去几年增长显著,有超8000客户。主打产品Claygent优势,能自动化业务流程,还获众知名企业高度评价。

AIGC开放社区
产品应用7

Claude后台接管电脑,真·赛博替身!人机并行时代来了

Anthropic宣布全面升级Claude「计算机使用」能力,操作可在后台完成。该功能处于Beta测试,已向Claude Pro和Max订阅的macOS用户开放。Claude此次更新覆盖场景,人机并行时代或来临。

新智元
新闻资讯8

王阳明心学,被Anthropic用来教Claude做人了

UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。

量子位
算法论文8

没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~

AI写代码能力提升,但打分方法僵化且成本高。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。

PaperAgent
算法论文8

「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据

复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量与对齐程度,在蒸馏实验中与学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。

机器之心
开源动态7

DragonMemory:16倍语义压缩,为RAG应用瘦身

介绍GitHub项目DragonMemory,它针对RAG应用上下文压缩,核心是Dragon v7模型,从序列维度压缩,压缩比达16倍。本地测试效果好,有图形界面,支持格式文档,开源但非成熟商业产品。

AI工程化