看表测试」共找到 2198 篇相关文章

产品应用8

MiniMax秀了波AI视频杂技:越越惊艳,指令遵循太强了

MiniMax发布海螺2.0版本,能处理极端物理情况,原生支持1080P,在指令遵循、生成质量达一流水平,成本效率破纪录。此前还开源MiniMax - M1,两大底层技术创新让其成果惊艳,展现研发实力。

量子位
产品应用7

物理引擎 + 视频生成!输入一张图,让AI演给你真实物理世界

WonderPlay将物理仿真与视频生成结合,从单张图像生成动态3D场景。它引入混合生成模拟器,形成物理求解器与视频生成器闭环。与其他方法对比,WonderPlay在多种场景和材质下现更优。

带你学AI
算法论文7

Fable5仅做对3.5%!大模型会图,但还没有主动视觉

本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。

机器之心
算法论文8

给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体状态、做决策

上海交通大学和小红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中现出色。

深度学习自然语言处理
产品应用7

龙虾开始自己拍电影了:我在 LibTV 里着它从一句话做到成片

作者试用 AI 视频产品 LibTV,仅给 Claude Code 发一句话“「黑神话哪吒」视频制作”,约 10 分钟就得到视频初稿。LibTV 能搭好 0 到 60 的地基,留下可继续创作的画布,成本低还能多尝试,最后仍需人把关。

AI产品自由
新闻资讯8

数GPU,未来:一张懂中美AI公司的真实实力差距,算力盘点

文章全面盘点中美头部AI公司GPU数量、资本开支和算力规划。美国科技巨头疯狂投入,如Meta、微软等;中国公司在禁令下抢购囤货并加速国产替代,如字节跳动、阿里等。还分析了中美差距及投资关注点。

AI Reading Hub
算法论文8

测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因

Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。

PaperAgent
产品应用8

Qoder 发布首个自进化的智能体: Quest 如何重构了 Quest

Qoder 发布首个自进化智能体 Quest,它能自主完成重构自身长程任务执行逻辑等任务。Quest 从上下文管理、工具选择、Agent Loop 三方面优化架构,还具备自主进化能力,正探索自主编程新可能。

阿里云开发者
新闻资讯7

周末我去泡温泉按模,顺带做了黑客松评委,到了下一个趋势

作者黄叔参加百度世界与小红书科技打造的黑客松活动,其赛道分解决实际需求和精神需求两类。10 年出生小朋友获一等奖,作品创意惊艳。活动体现开发门槛降低、开发者多样,AI 应用效果涌现。

AI产品黄叔
算法论文8

ICLR神秘论文曝光!SAM3用「概念」世界,重构视觉AI新范式

2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。

新智元