多模态深度调研」共找到 1661 篇相关文章

新闻资讯7

北大校友孙之清C位出镜,小扎看OpenAI直播夺人!1亿刀薪酬光速被签

CoT之父Jason Wei离职后,又一华人科学家孙之清入职Meta。他曾在OpenAI与奥特曼同框直播,此前深度参与o3等项目,还带头做「ChatGPT Agent」技术实现。加上Jason Wei等,三人都加入Meta。

新智元
产品应用7

高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
产品应用7

模力工场 030 AI 应用榜:字节新品硬刚 Sora,“随变”登顶榜首

模力工场第 030 周 AI 应用榜揭晓,32 款应用上架,从社区声量高的应用中精选十款。涵盖创作、学习、智能自动化、心理疗愈等领域,上榜应用凸显 AI 从‘简单生成’向‘深度交互与高效执行’转变趋势。

AI前线
产品应用8

豆包的新身份曝光:在国际艺术展当起了“AI讲解员”

文章讲述作者在浦东美术馆「AI与艺术」豆包讲解体验日活动的经历,实测豆包作为AI讲解员的业务水平,如筛重点、实时讲解、补知识,还揭秘其靠豆包大模型1.8的多模态处理等能力任职。

量子位
算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理
新闻资讯8

LeCun亲自官宣!Meta世界模型V-JEPA 2登场!仅用62小时机器人数据,就能实现零样本控制!

Meta发布V-JEPA 2世界模型及三个新基准测试,Meta首席AI科学家Yann LeCun介绍其不同。V-JEPA 2基于视频训练,用62小时机器人数据就能实现零样本控制,还将探索分层式模型和多模态建模。

AI科技大本营
开源动态8

诺奖得主实验室走出的中国团队,正用世界模型重构生命分子设计

过去 AI 分子设计多困于‘模态孤岛’,难以跨模态理解和设计。诺奖得主实验室走出的中国团队推出 ODesign 开源项目,将多模态分子纳入统一框架,展现跨模态迁移能力,团队创立英灵殿科技欲重构药物研发流程。

机器之心
8

李曼玲、李飞飞、吴佳俊等联手:评估具身大模型的新范式!

全新的具身模型空间能力评估范式Theory of Space突破传统局限,考察模型在动态环境构建、修正和利用空间信念的能力。该论文被ICLR 2026接收,研究对前沿多模态大模型评测,揭示其空间认知能力边界。

新智元
推荐文章7

一个极度实用的Prompt,帮你挖掘出自己的隐藏天赋。

作者朋友被裁后认为自己没天赋,作者由此思考天赋问题,花时间迭代出挖掘天赋的Prompt,借助AI与人深度对话,根据回答输出天赋报告,还举例自己找到天赋的经历,强调找到天赋的重要性。

数字生命卡兹克