多模态提示框架」共找到 2832 篇相关文章

产品应用8

Qwen3.7:智能体新前沿

阿里云正式发布面向智能体时代的Qwen3.7-Max模型,将通过API提供服务。它能力全面,编程、办公、长周期执行等表现出色,适配多框架,在多场景评测中领先,能驱动生产力跃升,还经多实战测试验证实力。

千问大模型
推荐文章8

Anthropic 的 Harness 哲学:把 Agent 当牲口,而非宠物

本文分享Anthropic最新两篇博客,介绍其将运维圈“宠物 vs 牲口”哲学用于AI Agent架构设计。旧架构如“宠物”易出问题,新架构脑手分离,把Harness做成可随时重启的“牲口”,降低延迟、提升安全,还提出信任框架

AGI Hunt
算法论文8

ICLR 2026|首个微观世界模型MicroVerse来了,AI开始模拟看不见的世界

过去两年,世界模型成为大模型演进重要方向,但现有模型多聚焦宏观世界。本文提出MicroVerse模拟框架,将研究边界拓展到微观尺度,还推出MicroWorldBench评测基准和MicroSim - 10K数据集,推动AI从视觉模拟迈向科学模拟。

机器之心
开源动态8

社区供稿丨迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro

2月4日,上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0时代提供开源基座。其核心能力跃升,架构创新,协同通用与科学能力,还构建‘算力 - 算法’基座,高质量开源赋能生态。

Hugging Face
开源动态8

港大开源ViMax火了,实现AI自编自导自演

香港大学黄超教授团队开源ViMax框架,在GitHub获高星标。它借助多智能体协作实现AI自编自导自演视频,突破主流模型在长视频制作的瓶颈,采用多种策略应对技术挑战,不过在多方面仍有提升空间。

机器之心
新闻资讯8

LeCun亲自出镜打脸质疑者!憋了20年的AI世界模型,终于爆发了

LeCun亲自出镜介绍V-JEPA 2新进展,目标是开发改变AI与物理世界交互的世界模型。V-JEPA 2基于视频训练,有两阶段训练细节,能用于机器人规划,Meta还发布三个基准测试,后续将研究分层和多模态JEPA模型。

新智元
产品应用7

Seedance 2.5 专业创作实测:3D导演台、局部重改、角色库如何释放模型能力

Seedance 2.5升级,3D导演台自带图片生成白模功能、打通3D工作流;有片段重拍实用功能;小云雀升级角色资产能力。除素材增加,其更理解原视频创意逻辑,还有多模态参考等功能,降低创作门槛。

AI进修生
产品应用8

做了十年设计,这次真觉得自己多余了|GPT-Image-2 上手实测

作者对刚发布的GPT - Image - 2进行上手实测,发现它无需复杂提示词,随手几个字就能出好效果。在互联网运营图片、知识类卡片、游戏设计、论文解释、网页设计等多领域表现出色,或冲击设计行业。

歸藏的AI工具箱
算法论文7

BeyondSWE:AI编程80分是真的强,还是考卷太简单?

前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。

PaperAgent
算法论文8

真机RL杀疯了!机器人自学20分钟100分,数字孪生封神

至简动力等提出数字孪生协同强化学习框架 TwinRL,可在真机高效执行在线强化学习。它用手机构建数字孪生,让机器人先探索再真机操作,20 分钟达 100%成功率,比现有方法快 30%,还降低人类干预。

新智元