统一大模型」共找到 9273 篇相关文章

算法论文8

挤干模型高分「水分」!最强模型仅49分,南傅朝友发布Video-MME-v2

南京学傅朝友团队在 Google Gemini 评测团队邀约下推出视频理解新基准 Video-MME-v2。它有创新的分层能力体系与组级非线性评分,揭示模型与人类的巨鸿沟、传统 Acc 指标虚高、“Thinking”并非总是增益等现象。

机器之心
算法论文8

首篇全新情景认知视角的模型Agent综述

中科的这篇Survey从全新情景认知视角对模型Agent进行综述,给出Agent本质,介绍Agentic AI定义、模型五层演化理论等,还以OpenClaw为例说明,旨在提供理解框架与未来方向。

PaperAgent
开源动态8

The Batch:841 | 语言模型正在纠正历史遗留的不公

美国北加州旧不动产契约含种族歧视条款,人工筛查耗时久。斯坦福和普林斯顿学研究人员微调语言模型实现自动识别,分析圣克拉拉县契约,发现诸多受影响土地,且揭示少数开发者推动住房隔离,模型已开源。

DeeplearningAI
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。

GiantPandaLLM
算法论文8

750篇论文,彻底把统一多模态模型摸清了

未来迈向AGI需多模态AI系统。南等联合发表综述,涵盖754篇文献。分析传统路线痛点,介绍统一多模态模型定义、技术路线、训练方法等,还提及应用场景及未来方向。

PaperAgent
新闻资讯8

谷歌年度招:所有AI模型全升级一遍!Gemini2.5杯中杯霸榜前二,新版视频/图像模型亮相

谷歌在I/O会放招,升级所有AI模型,重做原有产品,推出诸多实验性新产品。如Gemini 2.5系列升级,具备新功能;还有异步代码助手Jules、新搜索模式等,多模态模型也全线升级。

量子位
开源动态8

【万字长文】模型开源开发全景与趋势解读

本文以蚂蚁开源团队视角,基于OpenDigger数据,分析模型开源开发生态。呈现2025年全景图,涵盖135项目。指出训练、推理、应用侧主导领域,还探讨生态趋势、项目兴衰及近期厂商动态。

InfoQ
开源动态8

103K「硬核」题,让模型突破数学推理瓶颈

现有语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交团队推出DeepMath - 103K数据集。它规模、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。

机器之心
产品应用7

iPhone 17 Pro居然能跑8B模型

iPhone 17 Pro竟能跑8B模型,如Qwen3 - 8B,推理较流畅。作者换机一是因eSIM,二为拍视频。其认为AI普及需端侧落地,此机芯片性能是好信号,盼出优质iOS客户端。

newtype AI
新闻资讯8

国足缺席世界杯,但中国模型们集体参赛

联想在2025联想天禧AI生态伙伴会宣布举办AlphaGoal预测杯,8家中国模型将与普通球迷、开发者的AI Agent同台,预测世界杯赛果。这或触发足球体验革命,推动AI走向真实世界。

量子位