「多模态方法」共找到 1356 篇相关文章
382人、平均95后,MiniMax百亿估值冲刺IPO!招股书首次披露业绩:研发成本仅为OpenAI的1%、收入猛增8倍
12月21日,通用人工智能公司MiniMax通过港交所上市聆讯。其员工年轻,研发成本仅为OpenAI的1%,收入猛增,产品覆盖多模态。此次聆讯或倒逼行业转向“经营叙事”,加速行业分化。
摩尔线程背后大赢家:早期投资人回报已超6200倍
摩尔线程今日登陆科创板,市值达2800亿。其自创立受资本关注,融资超百亿。沛县乾曜早期190万投资增值超6200倍。虽曾遇美国制裁危机,但仍业绩增长,彰显了国产GPU企业的突围能力。
顶级邪修再战 Nano Banana Pro ,超多玩法,太猛了这玩意!
谷歌发布 Nano Banana Pro 模型,将图片模型能力推向顶峰,支持中文。它能生成准确视觉内容、多语言文本,可混合多元素,支持多分辨率。经测试,其各方面表现出色,应用场景丰富,版权限制宽松,三方应用和谷歌官方均可使用。
医疗AI智能体全面综述:行业爆发,年增长130%!
研究人员发布医疗健康AI智能体全面综述,梳理其全生命周期。数据显示截至2025年相关论文较2024年增超130%。研究前沿在数据、技术、应用上扩展,同时指出面临的挑战与未来方向。
抖音SAIL团队联合港中文MMLab推出SAIL-Embedding:打通「视、文、音」的全模态嵌入
字节跳动抖音SAIL团队联合港中文MMLab提出SAIL - Embedding,专为大规模推荐场景设计,实现视、文、音统一表征,解决传统多模态模型局限,在抖音业务场景效果显著,相关技术报告已公开。
AI 六小龙近况:零一万物迎来三位新高管,李开复提出“一把手工程 ”
AI六小龙中的零一万物进行新一轮高管任命,沈鹏飞等三人加入。同时提出“一把手工程”核心战略,以“一横多纵”打法构建新格局,推动大模型ToB解决方案落地,探索AI商业化新方向。
Anthropic、Thinking Machines Lab论文曝光:30万次压力测试揭示AI规范缺陷
Anthropic和Thinking Machines Lab等机构研究人员提出模型规范压力测试法,基于细粒度价值体系生成超30万个查询场景,分析12个前沿大模型回答,揭示模型规范存在原则冲突、解释歧义等缺陷。
腾讯王者归来:混元图像3.0登顶LMArena!一手实测全球最强图像AI
LMArena最新榜单显示,腾讯「混元图像3.0」在文生图任务中夺冠,碾压谷歌Nano banana和字节Seedream 4。它9月28日开源,性能对标闭源模型,有强大推理、语义理解能力,支持中英文长文本渲染。
登顶多模态推理榜MMMU!UCSD新方法超越GPT-5、Gemini
加州大学圣地亚哥分校团队开发的DreamPRM-1.5在MMMU测评榜夺冠,超越GPT-5、Gemini 2.5 Pro Deep-Think。它细化加权粒度到样本,有Instance Table和Instance Net架构,采用双层优化与生成式奖励模型。
刚刚,OpenAI在ICPC 2025编程赛上满分登顶,Gemini也达到金牌水平
在ICPC 2025编程赛上,OpenAI 5小时内解决12个问题满分登顶,其由通用推理模型集成体构成,结合GPT - 5与实验性模型;Gemini解决10个问题达金牌水平,在部分难题表现出色。