医疗大模型」共找到 9212 篇相关文章

算法论文8

读万卷书,模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源

Meta超级智能实验室与牛津团队新论文发现,只见过文本的语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。

机器之心
算法论文8

ICLR 2026 Oral | 让模型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测

生成式AI发展使深度伪造技术安全隐患受关注,现有检测器表现不佳。中科院自动化所联合蚂蚁集团提出Veritas框架,构建HydraFake数据集,赋予模型“模式感知推理”能力,实验效果超现有检测器,还给出未来研究方向。

深度学习自然语言处理
算法论文8

Nature子刊封面:牛津提出首个百万级多模态心脏基础模型CSFM

牛津学团队推出全球首个心脏传感基础模型CSFM,能统一分析多源数据,精准诊断房颤、预测死亡风险等。它打破设备壁垒,让偏远地区也能享用顶级心脏监护,推动全球医疗平权。

新智元
产品应用7

AI看病成为医患新包袱?补上「多轮追问」,通用AI才迈得过医疗

如今患者依赖AI问诊加重医患沟通负担。百川智能推出的Baichuan - M4对通用模型做结构性重构与医疗专项增强。M4在能力结构上升级,其C端产品百小医能与患者深度建联,有望构建医疗健康新生态。

量子位
算法论文8

NVIDIA港MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍

自回归语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

机器之心
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
算法论文8

斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量模型

斯坦福学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。

AIGC开放社区
算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通

上海交通学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
开源动态8

字节跳动开源文档解析模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
产品应用8

AI真有希望考清北了!豆包1.6多模态推理发威,闯关数理化带图

火山引擎原动力会发布豆包模型1.6,它是国内首款多模态SOTA模型,支持256k上下文长度。实测中它解答高考数理化带图题表现出色,还具备图像识别、视频理解、GUI操作等能力。此外,火山引擎还推出系列工具和平台助力企业。

新智元