可扩展监督」共找到 4374 篇相关文章

开源动态8

开源白嫖!微软这个开源 Agent,让 AI 帮你点按钮、填表格、跑多步流程(还跨设备)

微软开源智能自动化框架 UFO,主线是 UFO³(Galaxy 多设备编排)+ UFO²(Windows 桌面 AgentOS)。能将多步任务拆分执行,解决跨应用、多步骤甚至跨设备任务难题,有多种功能亮点。

小华同学ai
新闻资讯7

OpenAI发布新模型 GPT-Rosalind:专攻生物学、药物发现和转化医学

OpenAI发布生命科学前沿推理模型GPT - Rosalind,目标是生物学研究等领域。它是生命科学模型系列首款产品,在多方向表现强。当前以研究预览版向特定合作机构开放,有意机构申请。

AI寒武纪
推荐文章8

Andrej Karpathy:AI本质是「软件2.0」,并非电力或者工业革命

Andrej Karpathy分享AI影响经济的思考,认为应将AI视为“软件2.0”,提出预测AI自动化能力的“验证性”指标,回顾软件1.0,阐述软件2.0,指出“验证性”决定AI进展的“锯齿状”前沿。

AI寒武纪
算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论
新闻资讯7

OpenAI商业帝国野心初现,ChatGPT上线“即时结账”功能:聊天就能直接下单

OpenAI为ChatGPT推出“即时结账”功能,由代理商业协议(ACP)支持,将用户产品发现对话转化为购买行为。商家能在需求源头捕获消费意向,用户在对话内完成购买。目前仅在美国向美商开放。

AI寒武纪
算法论文8

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

强化学习与验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。

机器之心
开源动态8

首个基于MCP 的 RAG 框架:UltraRAG 2.0用几十行代码实现高性能RAG, 拒绝冗长工程实现

检索增强生成系统(RAG)复杂度提升,工程实现成本高。清华大学等联合推出首个基于MCP架构的UltraRAG 2.0,组件化封装、调用扩展灵活,低代码实现高性能,用于科研和行业应用。

AI前线
新闻资讯8

英伟达发布了跨 AI、机器人和自动驾驶的开放模型、数据集和工具

英伟达发布涵盖多领域的开放模型、数据集和开发工具,扩展多个模型家族。代理式AI领域扩展Nemotron;机器人技术引入Cosmos;自动驾驶有Alpamayo;医疗保健有Clara相关模型。均开放许经GitHub等访问。

InfoQ
开源动态7

只要强化学习1/10成本!翁荔的Thinking Machines盯上了Qwen的黑科技

新智元报道,翁荔的Thinking Machines研究同策略蒸馏策略,能以1/10强化学习成本,结合同策略训练优势与密集奖励信号。该策略受DAGGER启发,扩展Qwen3团队工作,在Tinker复现,还能用于个性化和持续学习。

新智元
算法论文8

AST | 西工大马龙、邬晓敬等:几何特征知识驱动的代理优化方法

机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。

力学与人工智能