全模态强化学习」共找到 1634 篇相关文章

新闻资讯8

寻明生科获1亿美元B轮融资,加码基座模型开拓AI药物发现新边界 | 5Y News

近日,寻明生科宣布完成1亿美元B轮融资,累计近2亿美元。资金将投入生物基座模型研发与规模化训练,升级Lab - in - the - Loop体系。该公司构建闭环AI原生基础设施,其模型能力获验证,商业变现多元。

五源资本 5Y Capital
开源动态8

一个开源平台,编织起了Agent「互联网」

如今 Agent 单体能力强但系统分散,开源平台 Octo 应运而生。它由明略科技打造,可聚合 Bot,让其成为企业级资产。Octo 重写协作,有 Matter 沉淀任务,塑造 Taste 让 Agent 更懂用户,还有六种协作模式。

机器之心
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化新突破

当前VLA模型常依赖视觉线索而非语言指令,导致新场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元
开源动态8

【开源】build-your-own-x:30+领域造轮子教程,程序员内功提升指南

开源项目 build-your-own-x 收录 30+ 领域「从零造轮子」教程,解决学编程只知用不知原理的问题。涵盖 3D 渲染、AI 模型等多领域,多语言可选。介绍学习好处、使用方法,还推荐优质教程。

小华同学ai
新闻资讯8

小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听

小米官宣MiMo-V2家族三款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。

量子位
算法论文8

仅保留35% Token,性能反超原模型!快手可灵等用视觉信息引导音频压缩,推理时间直降42%

Omni - LLM计算浪费严重,快手可灵等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token数量,提升性能和推理效率。

量子位
开源动态8

FlashAttention-4正式发布:算法流水线大改,矩阵乘法级速度

深度学习领域底层优化技术FlashAttention更新至4版本。其核心作者称在Blackwell GPU上,注意力机制执行速度接近矩阵乘法。新算法克服瓶颈,在B200上性能提升,还获Pytorch官方支持。

机器之心
新闻资讯8

当世界在谈论AI替代人类时,松鼠Ai在达沃斯带回了什么答案?

2026年达沃斯论坛上,松鼠Ai创始人栗浩洋展示教育普惠新路径,其智适应学习系统成本低且效果好。该系统经科学与规模验证,还引发经济核算思考,其全球化发展受国际资本关注。

新智元
推荐文章8

有手就行,教你从0到1快速手搓搭建个GUI Agent

随着通用大模型发展,搭建GUI Agent难度降低。文章介绍如何用通用大模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。

腾讯技术工程
算法论文8

GAG:超越RAG,无需检索的私有知识注入新范式

在高价值私有场景,主流大模型注入知识的路线各有硬伤。中科院和360AI联合团队提出GAG方案,无需检索、固定底座、单Token、即插即用,实验显示效果佳,也指出跨域组合等局限。

PaperAgent