全模态推理」共找到 3756 篇相关文章

产品应用8

比「小龙虾」更能打,中国AI视频大模型悄悄登顶球第一

昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。

机器之心
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区
开源动态8

微软GigaTIME登上《Cell》:5美元切片变成免疫图谱

微软GigaTIME登上《Cell》,能把5美元H&E切片翻译成稀缺免疫图谱,在人群尺度重建TIME。它突破癌症免疫研究旧限制,成果经多数据集验证,已在Foundry Labs与HuggingFace量开源。

新智元
算法论文8

基于文本AI的终结?Agent协作可直接「复制思维」,Token效率暴涨

在 Agentic AI 时代,多智能体系统让 AI 从单打独斗变为团队协作。普林斯顿大学等机构研究者提出多智能体推理框架 LatentMAS,将协作从 token 空间转移到潜在空间,实验显示其性能、效率大幅提升。

机器之心
新闻资讯8

云计算一哥10分钟发了25个新品!Kimi和MiniMax首次上桌

亚马逊云科技CEO在re:Invent 2025上10分钟发25个新品,2小时近40个。围绕AI Agent,从算力到模型、平台、应用面布局,还引入中国Kimi和MiniMax,构建栈壁垒,助力企业用好AI。

量子位
算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
推荐文章7

深入剖析AI公司正在面临的:「囚徒困境」

文章指出AI模型训练成本虽下降,但运营成本尤其是推理费用飙升,使AI公司陷入两难。用户只青睐最强模型,且模型资源消耗远超预期,订阅模式难以为继,还给出了避免亏损的三条出路。

AINLPer
新闻资讯8

DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率

ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。

InfoQ
推荐文章7

Token成本下降,订阅费却飞涨,AI公司怎么了?

文章指出,虽模型训练成本下降,但 AI 公司运营成本尤其是推理费用猛增。以固定费率订阅和高 token 消耗的商业模式的公司面临困境,如 Windsurf、Claude Code 等,还给出避免亏损的三条出路。

机器之心
新闻资讯8

IMO 主席正式宣布:Google DeepMind在国际数学奥赛拿下金牌!

Google DeepMind的Gemini Deep Think模型在2025年IMO竞赛获金牌水平成绩。虽比OpenAI公布晚,但实现用自然语言解题质的飞跃。它采用增强推理模式,成绩经官方认证,后续将向用户开放。

AGI Hunt