多模型集成」共找到 9878 篇相关文章

算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。

AINLPer
算法论文8

Arc研究所造出能“举一反三”的虚拟细胞模型,破解跨细胞预测难题

生物学和药物研发中,因细胞组合庞大,难以全实验验证,且同药在不同细胞效果不同。Arc Institute 团队推出虚拟细胞模型 STATE 及评测套件 Cell - Eval,STATE 预测效果优,但也存在短板。

DeepTech深科技
开源动态8

世界模型有了开源基座Emu3.5!拿下模态SOTA,性能超越Nano Banana

北京智源人工智能研究院的悟界·Emu3.5是最新最强的开源原生模态世界模型,能处理图、文、视频任务,在项权威基准上性能亮眼,还具备理解长时序等能力,背后有技术创新,且选择开源。

量子位
新闻资讯7

Elad Gil:AI 应用进入收敛期,比模型跑得快才能抓住红利

硅谷AI投资人Elad Gil回顾AI领域投资,指出AI应用进入收敛期。基础模型头部梯队明显,格局难改;GPT-ladder带来新机会;应用端理解痛点、构建工作流的团队更有优势,AI Agent重塑商业模式。

Founder Park
开源动态8

CAIR开源发布超声基座大模型EchoCare“聆音”,10余项医学任务性能登顶

2025年9月17日,CAIR开源发布超声基座大模型EchoCare“聆音”。它基于超450万张影像数据集训练,在10余项医学任务测试中表现卓越。首创结构化对比自监督学习框架,为AI医疗应用提供创新路径。

机器之心
开源动态8

「被动感知」到「理解接触」!它石智航重磅发布OmniVTA视触觉世界模型

它石智航联合六大顶尖机构推出OmniVTA视触觉操作框架和OmniViTac大规模视触觉数据集。该框架核心是从被动感知到主动预测触觉,通过模块协同让机器人有预测、理解和修正能力,实验表现优。

新智元
开源动态8

阿里重磅开源:端到端VLM文档解析模型,图片直出结构化HTML!

在AI文字识别类应用中,文档解析常不尽人意。阿里开源端到端文档解析模型Logics - Parsing,基于VLM,能图片直出结构化HTML,有统一、智能、精细等亮点,还给出使用步骤。

开源星探
新闻资讯8

刚刚,唐杰、杨强、杨植麟、林俊旸和刚回国的姚顺雨坐一起都聊了啥?

1月10日AGI - Next前沿峰会上,智谱AI唐杰、月之暗面杨植麟等大模型掌舵者及学界泰斗罕见同台。他们探讨AI从‘聊天机器人’进化为‘干活的智能体’,但解法各异,还在圆桌激辩个敏感话题。

机器之心
算法论文8

让大模型合成检查器:UIUC团队挖出Linux内核90余个长期潜伏漏洞

伊利诺伊大学香槟分校张令明老师团队的论文提出KNighter,它让大模型生成静态分析检查器,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀为规则,带来可落地等好处。

机器之心
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent