可灵 2.1 首尾帧模型」共找到 9063 篇相关文章

新闻资讯7

永别了,人类冠军!AI横扫天文奥赛,GPT-5得分远超金牌选手2.7倍

国际天文与天体物理奥赛(IOAA)中,GPT - 5和Gemini 2.5 Pro完胜人类选手。俄亥俄州立大学团队考察五大顶尖LLM,发现它们大多达金牌水平,但在几何、时空推理等方面有困难。

新智元
算法论文7

模型自信心崩塌!谷歌DeepMind证实:反对意见让GPT-4o轻易放弃正确答案

谷歌DeepMind携手伦敦大学研究发现,GPT - 4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为,原因与训练、决策逻辑、记忆机制有关。研究还通过两轮实验证实。

量子位
推荐文章7

AI Agent时代的「AWS」:Manus 背后的重要功臣 E2B 是何来头?

文章介绍 E2B 这一开源基础设施,它为 Manus agent 提供虚拟电脑支持,允许在云端安全沙盒运行 AI 生成代码。其沙盒月创建量一年增 375 倍,CEO 目标是成 AI Agent 时代的 AWS,还探讨了 AI Agent 相关问题。

Founder Park
新闻资讯7

凭借 27 万小时真机数据,Generalist 可能是最接近“GPT-1 时刻”的顶级机器人团队

Generalist是机器人领域有潜力的公司,凭借27万小时真机数据或达GPT - 1量级,领先6 - 12个月。团队成员来自顶尖机构,技术强,demo展示出模型灵巧性。不过也面临Scaling Law不确定、数据缺口大、商业化场景缺失等风险。

海外独角兽
产品应用8

ZeroGPU Spaces 加速实践:PyTorch 提前编译全解析

本文聚焦 ZeroGPU Spaces 加速实践,介绍 PyTorch 提前编译。ZeroGPU 使在 Hugging Face Spaces 用 Nvidia H200 硬件更高效,但有局限。提前编译可优化模型,提升演示速度,还分享了接入方法、高级技巧及演示示例。

Hugging Face
新闻资讯7

人类秒懂,AI崩溃:一个简单测试,就让GPT-5、Gemini等顶级模型集体“翻车”

来自多机构研究团队发现,OpenAI的GPT-5等顶级AI模型,面对‘看得见但读不懂’文字时表现极差。VYU团队实验显示,人类能轻松读懂的切分拼接文字,AI却全军覆没,原因是其靠模式匹配,不懂文字结构。

量子位
开源动态8

当LeCun还在「画饼」,中国AI大牛领先李飞飞一步把世界模型开源了

具身智能突破「遥操作」数据桎梏,商汤联合创始人王晓刚领衔的大晓机器人发布全球首个开源商业落地世界模型「开悟3.0」。它是多模态理解 - 生成 - 预测一体化,有强物理感知力,还解决了空间感和时间记忆问题。

新智元
算法论文8

首个3D动作游戏专用VLA模型,打黑神话&只狼超越人类玩家 | ICCV 2025

淘天集团未来生活实验室团队提出首个3D动作游戏专用VLA模型CombatVLA,已被ICCV 2025接收。它能处理视觉输入输出动作指令,在战斗理解准确率和执行速度上表现优异,还构建了评测基准等。

量子位
新闻资讯7

猝不及防,Adobe关停2D动画软件Animate拥抱AI!最惨学生:一学期的课白上了

Adobe宣布将于2026年3月1日停止销售2D动画软件Animate,企业客户可获三年服务,其他用户仅一年。该软件历史超25年,虽有衰落但仍被不少人使用,Adobe此举或因重心转向AI。

量子位
产品应用8

这一次,谷歌Veo 3.1教Sora做视频!角色0变形,4K竖屏直接满分

谷歌Veo 3.1迎来重磅升级,优化移动端体验,上传素材图片就能创作有趣视频。亮点包括素材生视频一致性强、支持原生竖屏输出、有业界领先的1080p和4K超分辨率,现已可在多平台体验。

新智元