大模型V4」共找到 9263 篇相关文章

算法论文8

挤干模型高分「水分」!最强模型仅49分,南傅朝友发布Video-MME-v2

南京学傅朝友团队在 Google Gemini 评测团队邀约下推出视频理解新基准 Video-MME-v2。它有创新的分层能力体系与组级非线性评分,揭示模型与人类的巨鸿沟、传统 Acc 指标虚高、“Thinking”并非总是增益等现象。

机器之心
开源动态7

新玩法!Karpathy周末手搓“模型智囊团”应用:各LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个模型像顾问般提供建议。查询通过OpenRouter分发给多个模型,它们互评后由‘模型主席’生成最终回复,代码已开源。

AI寒武纪
产品应用8

九天模型变身:性能狂飙35%!还能一键P

7月26日,中国移动在2025世界人工智能会发布「九天」基础模型3.0,端到端技术全面升级,复杂推理能力提升35%,智能体调用效率提升21%,还推出代码、数学等专项模型,多模态能力也焕新。

新智元
新闻资讯7

2025上半年模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高

推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。

Founder Park
开源动态8

小米MiMo-V2-Flash开源:3090亿参数模型能否改写AI行业规则!

2025年12月16日小米开源旗舰模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。

MCP Server
7

华为盘古模型:被芯片牵制的“千古”模型

华为盘古模型团队员工自曝内幕,称其受芯片限制,早期算力有限、训练困难。还指出内部存在造假、套壳等问题,如135B V2套壳Qwen 1.5 110B,pangu pro moe 72B套壳qwen 2.5的14b等,导致人才流失。

Agent的潜意识
算法论文8

告别单一模型依赖!北航等机构发布综述:语言模型集成(LLM Ensemble)

北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三集成范式。

PaperAgent
算法论文8

牛津VGG、港、上交发布ELIP:超越CLIP等,多模态图片检索的增强视觉语言模型预训练

牛津VGG、港、上交团队论文提出ELIP方法,用学术界资源增强视觉语言模型预训练,用于文字 - 图片检索。该论文被会接受并获最佳论文提名。ELIP可应用于多个模型,实验显示能显著提升图片检索表现。

机器之心
推荐文章7

特征工程、模型结构、AIGC——模型在推荐系统中的3落地方向|文末赠书

文章指出模型在三个层次改变推荐系统,一是改变“知识学习”方式,带来知识输入革命;二是改变“智能体”结构,探索推荐模型新范式;三是创造“新世界”,实现个性化内容生成。还介绍了相应落地应用及对从业者的建议。

AI前线
新闻资讯8

真正面向模型的AI Infra,必须同时懂模型、系统、产业|商汤装置宣善明@MEET2026

商汤装置副总裁宣善明在MEET2026会分享进展,强调模型时代AI Infra要解决算力高效支撑问题。商汤战略“1+X”,装置有优势,算电协同成果好,还推动国产化适配,产业落地成果多。

量子位