大模型推理」共找到 9477 篇相关文章

新闻资讯8

阿里刚投的AI明星,3D模型那种

通用人工智能公司VAST宣布完成5000万美元A轮融资,由阿里、恒旭资本联合领投。其自研3D基础模型领先,发布全新AI 3D模型家族。2025年重点研发世界模型,2026年将加速建设UGC互动内容平台。

量子位
新闻资讯8

斯坦福教授直播训练535B模型模型训练背后的「黑箱」正在被打开?

斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。

机器之心
产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传模型

Qwen3-LiveTranslate-Flash 是基于语言模型的多语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有多语言和方言支持、视觉增强等亮点,性能超主流模型

通义千问Qwen
算法论文8

团队提出 SHINE:将任意文本转化为模型 LoRA,仅需一次前向传播!

团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化为模型 LoRA 参数,支持多轮对话。该方法实用潜力、架构创新高效,训练流程成熟,推理快速,为模型持续学习提供新思路。

机器之心
算法论文8

景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态模型在线时空理解短板

上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战模型能力。它更贴近真实世界,揭示主流多模态模型在线时空理解短板,为未来模型发展指明方向。

机器之心
开源动态8

模型开网店,谁是经营高手?E-Commerce Bench开源揭秘

为评估模型长程经营能力,联合淘天集团发布E-Commerce Bench,以10万本金、365天经营网店来评测。从多维度评估18个模型,结果差异,还发现单一指标会掩盖模型表现,评估基准潜力

千问大模型
算法论文8

谷歌新研究:模型“吵架”有利于提升推理质量

谷歌新研究发现高级推理模型自发进化出'思想社会',研究人员用LLM - as - judge方法识别出多个虚拟人格。还找到控制现象的'开关',实验表明教AI'吵架'更有效,其'社交技能'通用,给开发者带来新启示。

AI工程化
产品应用8

模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理量纸质文档,起初考虑云端模型API调用和开源模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent
新闻资讯7

DeepSeek、GPT、Qwen,所有模型架构图都有,Karpathy:宝藏画廊!

模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心
开源动态8

R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式

复旦学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三瓶颈,训练后模型性能双重提升。

机器之心