多任务学习」共找到 6165 篇相关文章

新闻资讯7

特朗普刚下禁令,美军动用Claude空袭!军用版或已达Opus 5.5水平

WSJ报道,特朗普刚封杀Claude,美军就用其空袭伊朗。美军司令部用Claude做情报评估等。Anthropic为军方定制版或达Opus 5.5水平。Anthropic曾因隐私等问题与五角大楼谈判破裂。

新智元
开源动态8

让机器人「秒懂人话」!中国电信TeleAI发布首个实时文本驱动人形机器人控制框架TextOp

中国电信人工智能研究院(TeleAI)具身智能团队推出人形机器人TextOp通用小脑,首创流式文本驱动的实时小脑控制范式。用户发文本指令,机器人就能实时理解、无缝切换动作,在场景有应用潜力。

机器之心
开源动态7

3.5k星星!用AI推演、预测未来,这个开源体智能引擎做到了。

文章介绍开源体智能引擎MiroFish,它是基于智能体技术的AI预测引擎。用户提供种子文件、下达指令,它能构建数字沙盘,让AI智能体互动演化,可用于企业公关等场景,还给出推演流程。

开源AI项目落地
算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
算法论文8

无需奖励函数!我们意外构建了自我进化的AI系统

牛津大学发现LLM可通过“部署 - 验证 - 再训练”循环自我进化,绕开人工奖励函数设计瓶颈。在三个经典规划领域实验效果惊人,还在理论上证明其与强化学习的数学等价关系,有优势也有隐患。

AI工程化
算法论文8

GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在任务中表现良好。

机器之心
新闻资讯8

刚拿诺奖就登Nature封面!谷歌“量子回声”算法计算提速13000倍,可重复验证结果

刚获诺奖的谷歌量子团队登Nature封面,提出“量子回声”算法,计算提速13000倍且结果可重复验证。解决了量子计算结果难确认问题,该算法在领域有应用潜力,还依赖Willow芯片优势。

量子位
产品应用7

实测Kimi全新Agent模型「OK Computer」,很OK

Kimi发布全新Agent模型「OK Computer」,依托Kimi K2,能搭网站、做PPT、处理大量数据。实测显示它在设计、生成、分析类任务表现不错,设计无需找素材,分析无需想角度,生成还能推荐风格。

量子位
新闻资讯8

OpenAI两位首席最新采访信息量好大!终极目标是“自动化研究员”,招人并非寻找“最出圈”的人

OpenAI首席科学家Jakub Pachocki和首席研究官Mark Chen在采访中爆料,谈到GPT - 5将推理引入主流、实现自动化研究员目标、强化学习未到瓶颈等,还阐述用人标准、算力分配等问题。

量子位
新闻资讯7

2025 智谱 Z DemoDay :24 家值得关注的 AI 创企,看看今年创业都在做什么?

8月31日,星连资本、智谱Z计划主办的Z DemoDay举办,24个早期AI项目亮相,覆盖领域。路演外还有产品创造营,围绕AI产品设计研讨演练。大会还设创意活动,揭示AI时代创新本质是人类创造力。

Founder Park