生成式框架」共找到 3814 篇相关文章

产品应用7

体验完微信Agent以后,我觉得这就是微信有史以来最大的更新。

作者获微信小微内测资格,深度体验后认为这是微信最大更新。微信Agent打通原生能力有超预期之处,但智能程度不足。功能上有亮点也有限制,如通讯录操作谨慎、小程序适配佳,还能生成小工具。

数字生命卡兹克
新闻资讯7

李飞飞发布全新世界模型

李飞飞团队的World Labs发布两款新模型Marble 1.1和Marble 1.1 - Plus,能将平面照片转化为3D世界、提升画面清晰度。二者各有侧重,前者重画质优化,后者重空间生成,官方建议新用户从1.1开始用。

量子位
推荐文章8

万字长文|迈向电商大模型时代,从虚拟试穿聊到电商AIGC

本文是京东李岩博士在AICon2025的演讲整理。他从虚拟试穿切入,拆解其技术逻辑、行业实践与未来趋势,还介绍京东电商AIGC布局,如商品抠图、素材生成等能力,分享业务成果及对电商AIGC未来的看法。

InfoQ
算法论文8

无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025

KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。

量子位
算法论文8

哈工大、中科院等利用模型“潜意识”提高推理模型效率,0.6B撬动复杂推理

哈工大、中科院等提出TrajSelector框架,让推理模型‘倾听内心独白’。它利用模型隐藏状态,用0.6B轻量级验证器实现比7B裁判模型更精准选择,在数学竞赛基准测试中表现出色,还能离线筛选数据,但在开放域问答有难题。

AIGC开放社区
开源动态8

第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力

新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。

新智元
算法论文7

把 Gemini 和 GPT 放到《我的世界》当教练,谁能看懂机器人的微操?

国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。

AI科技评论
产品应用8

全球唯二、国内首个,阿里万相2.6杀疯!Sora 2瞬间不香了

阿里万相2.6系列模型上线,成为业界功能最丰富的视频模型,是全球唯二、国内首个具备角色扮演功能的模型。其音画一体,能生成15s长视频,指令遵循能力强。还可将提示词转换为多分镜脚本,团队公开了提示词公

新智元
新闻资讯7

Sora关停背后:为啥它没跑成“视频版ChatGPT”?

OpenAI Sora 宣布关停,评论区评价两极分化。其未成为“视频版 ChatGPT”,主要因踩中生成 AI 最难的三件事:使用频率、成本结构和产品形态。关停或与 OpenAI 筹备 IPO 有关,未来 Sora 团队将推进世界模拟研究。

AI前线
新闻资讯8

88岁图灵奖得主,用Claude一小时破解30年数学悬案

88岁图灵奖得主高德纳发文称,他研究数周、可追溯到30年前的三维图论开放问题,被Claude Opus 4.6仅用1小时、31次探索就破解,还给出通用构造算法,这让向来对生成AI保留的他致敬Claude。

量子位