手办图」共找到 530 篇相关文章

算法论文8

AI看一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位
新闻资讯7

刚刚,奥特曼发布GPT-5!人人免费用「博士级」智能,基准错误遭全网吐槽

OpenAI 发布 GPT - 5,奥特曼连发推文介绍看点。它是集成模型,有免费版、Plus 和 Pro 计划,多领域跑分亮眼。不过直播现小 bug,跑分出错,马斯克拆台,表现未达部分人预期。

机器之心
新闻资讯7

2025中国力学大会AI+分享 | 四川大学张来平研究员:基于神经网络的流场预测方法研究进展

2025中国力学大会AI+分享中,四川大学张来平研究员介绍基于神经网络的流场预测方法研究进展。张来平长期从事计算流体力学研究,近年专注AI for Science,成果颇丰。

力学与人工智能
新闻资讯7

豆包收费?GEO招标成标配?网信4个月整治AI乱象如何对待?

文章分享三则AI新闻。一是豆包拟收费,揭示中国AI免费时代倒计时,分析收费原因、电商难先行因素及收费前景,还探讨AI广告形态;二是GEO招标成标配,显示其成企业标配,布局AI搜索流量正当时;三是网信整治AI乱象,企业应自查、切割、重塑信任。

白杨SEO优化教程
推荐文章8

11篇顶会论文之外,美影像研究院做了一件事:让大众爱用AI

过去两年,AI 生成片、视频变得容易,但让 AI 理解并按创作者意创作很难。美影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。

机器之心
产品应用7

小哥硬核搓AI桌宠!接入GPT-4o,听得懂人话还能互动,方案可复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,搓AI桌宠Shoggoth,接入GPT - 4o,能与人互动。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
产品应用7

给 AI 一张陶罐碎片,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
开源动态8

三大核心创新公开,快开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。

PaperAgent
开源动态8

三大核心创新公开,快开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。

CourseAI
算法论文8

因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论