通用大模型」共找到 9322 篇相关文章

开源动态8

超越O4-mini,多模态模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态模型通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
开源动态8

一个模型读懂所有医学数据,Hulu-Med探索医学模型开源新范式 | 浙x上交xUIUC

Hulu - Med是浙、上交、UIUC等联合提出的通用医学视觉语言模型,首次在单一模型统一理解医学多类数据。它开源透明,训练成本低,性能媲美GPT - 4.1,为医学AI带来新范式。

量子位
开源动态7

新玩法!Karpathy周末手搓“模型智囊团”应用:各LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个模型像顾问般提供建议。查询通过OpenRouter分发给多个模型,它们互评后由‘模型主席’生成最终回复,代码已开源。

AI寒武纪
产品应用8

九天模型变身:性能狂飙35%!还能一键P

7月26日,中国移动在2025世界人工智能会发布「九天」基础模型3.0,端到端技术全面升级,复杂推理能力提升35%,智能体调用效率提升21%,还推出代码、数学等专项模型,多模态能力也焕新。

新智元
算法论文8

告别单一模型依赖!北航等机构发布综述:语言模型集成(LLM Ensemble)

北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三集成范式。

PaperAgent
算法论文8

牛津VGG、港、上交发布ELIP:超越CLIP等,多模态图片检索的增强视觉语言模型预训练

牛津VGG、港、上交团队论文提出ELIP方法,用学术界资源增强视觉语言模型预训练,用于文字 - 图片检索。该论文被会接受并获最佳论文提名。ELIP可应用于多个模型,实验显示能显著提升图片检索表现。

机器之心
推荐文章7

特征工程、模型结构、AIGC——模型在推荐系统中的3落地方向|文末赠书

文章指出模型在三个层次改变推荐系统,一是改变“知识学习”方式,带来知识输入革命;二是改变“智能体”结构,探索推荐模型新范式;三是创造“新世界”,实现个性化内容生成。还介绍了相应落地应用及对从业者的建议。

AI前线
新闻资讯8

真正面向模型的AI Infra,必须同时懂模型、系统、产业|商汤装置宣善明@MEET2026

商汤装置副总裁宣善明在MEET2026会分享进展,强调模型时代AI Infra要解决算力高效支撑问题。商汤战略“1+X”,装置有优势,算电协同成果好,还推动国产化适配,产业落地成果多。

量子位
算法论文8

面对无解问题模型竟会崩溃?港中文&华为联合提出首个模型推理可靠性评估基准

港中文和华为诺亚实验室联合提出ReliableMath基准,探究模型推理可靠性。提出评估准则,构建含可解与不可解问题的ReliableMath数据集,实验揭示模型缺陷,还提出提高可靠性的对齐策略。

机器之心
开源动态8

模型理解真实医疗视频,全球首个开源技术方案来了!

AI 进入医疗领域需谨慎,此前美国引入不成熟 AI 致手术失误频发。全球首个医疗视频理解模型元智医疗视频理解模型发布并开源,解决了医疗视频领域的任务优化、数据缺失和无法评测痛点。

机器之心