强化学习范式」共找到 2269 篇相关文章

开源动态7

阿里达摩院开源多模态医学大模型—灵枢

大模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三大难题。阿里达摩院开源统一多模态医学大模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
新闻资讯8

ChatGPT上瘾,大脑萎缩47%!MIT祭出206页92图超长报告

麻省理工学院完成针对ChatGPT用户的首次大脑扫描研究,发现长期依赖大模型,学习能力下降、大脑受损,神经连接减少47%。AI提高效率或为误解,使用它是用长期思维能力换短暂效率。

新智元
推荐文章7

为什么你的 AI Agent 总是用不起来?答案在 Skills

文章围绕AI Agent的Skills展开,介绍其范式价值,如从“单一智能”到“模块化智能”;还提及知识沉淀、跨平台能力迁移等作用,以及对人机关系、人力市场与劳动结构的影响。

AIGC开放社区
产品应用8

豆包,即将杀死比赛

本文讲述作者在不同场景的经历,展现豆包在大众心中的高认知度。还提及豆包用户规模领先、被业内人士使用、成内容创作热点等,且将深度嵌入春晚,或强化“AI = 豆包”印象。

特工宇宙
产品应用8

实测谷歌AI故事书,我实现漫画和绘本自由了

谷歌Gemini推出免费StoryBook工具,30秒左右可生成10页故事书,支持中文且内容有趣。测试显示,它在图像风格、故事创作上表现出色,还能作学习和展示工具,获网友好评。

量子位
开源动态8

Qwen-AgentWorld:一个语言世界模型,模拟七大Agentic领域

今天正式发布 Qwen-AgentWorld,它是首个原生语言世界模型,能在七大领域模拟智能体交互环境。同步发布 AgentWorldBench 评测基准。Qwen-AgentWorld 经三阶段训练,在评测中表现出色,还探索两种范式增强通用智能体能力。

千问大模型
开源动态8

“同事.skill”不用写了,爱马仕 Hermes 主动“蒸馏”你,还让开发者集体抛弃 “龙虾”?!

近日,Hermes Agent 在国内爆火,获超 5.2 万 stars 且还在增长。它与 OpenClaw 不同,采用单 Agent 架构,有学习循环和分层记忆系统。背后公司 Nous Research 目标是打造抗衡 OpenAI 的开源模型,还引入区块链解决算力问题。

AI前线
算法论文8

AI「看不懂」、「做不好」视频的问题,混元用「MTSS」解决了

腾讯混元团队提出 Multi-Stream Scene Script(MTSS)新视频描述范式,将传统方式升级为‘多流结构化剧本’。它解决了传统方式语义冗余、扩展性差等问题,在视频理解和生成任务表现显著。

机器之心
算法论文8

打破确定性魔咒!北航团队提出VBF++:用“不确定性建模”刷新多模态视频推荐 SOTA

北京航空航天大学和北京邮电大学联合提出VBF++框架,将多模态融合从“点估计”升级为“分布建模”。它由上下文感知先验、推荐引导的对抗优化和元学习三大组件构成,在多个数据集上刷新SOTA。

AI前线
开源动态7

OVI:统一的音视频生成模型,声音与画面同步诞生

音视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。

带你学AI