「世界模型Genie 3」共找到 8644 篇相关文章
高考第一天,用豆包修图3.0花式「整活」送祝福,已原地笑翻!
豆包的一句话P图功能进化,其图像编辑模型SeedEdit 3.0全量上线,AI修图进入3.0时代。用自然语言就能精准编辑图片,在文字编辑、局部修改等方面表现出色,还突破以往模型瓶颈,成设计师利器。
多模态模型挑战北京杭州地铁图!o3成绩显著,但跟人类有差距
近年来,多模态大模型在多种场景取得进展,但能否‘看懂图’存疑。西湖大学等团队提出评测基准ReasonMap,评估模型在地铁图理解中的能力,发现主流模型有瓶颈,闭源模型虽优但仍逊于人类。
万帧实时!流式3D重建天花板,被国产开源模型打破了
蚂蚁正式开源 LingBot-Map,这是基于几何上下文 Transformer 的纯自回归流式 3D 重建基础模型。它能在恒定内存下实现超万帧长视频实时三维重建,处理速度约 20 FPS,在多基准测试中超越现有流式方法。
ICLR 2026北京论文分享会启动,直击「AI龙虾」、世界模型新范式
2026 年人工智能领域,「龙虾」(OpenClaw)私人 Agent 助理成人机交互标杆,世界模型受关注。ICLR 2026 4 月将在巴西举行,机器之心 4 月 18 日在北京举办论文分享会,邀大家参与交流。
刚刚国产双响炮炸场!智谱「牛来模型」和阿里Qwen3.8-Flash双双亮相屠榜
智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。
2025上半年大模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高
推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年大模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。
4D通用世界模型!中科院NeoVerse用百万单目视频直接构建
中国科学院自动化研究所与CreateAI团队构建4D世界模型NeoVerse,它用全新端到端架构,从单目视频高效重建4D高斯泼溅,模拟成像退化提升生成鲁棒性,在多任务表现卓越。
AGI是否需要世界模型?顶级AI专家圆桌论道,清华求真书院主办
2025年7月20日,2025基础科学与人工智能论坛举行,孙茂松、刘铁岩等顶尖AI专家围绕AI根本问题展开讨论,涉及因果性、世界模型、原创能力、算力等方面,为AI技术发展勾勒图景与挑战。
视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系
香港大学、香港科大与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。
阿里千问大模型换将,32岁林俊旸官宣告别
阿里巴巴高级算法专家、通义千问大模型负责人林俊旸宣布告别千问团队,此前一晚千问团队刚推出Qwen3.5轻量化模型且获马斯克点赞。此外,Qwen3.5核心贡献者Kaixin Li和通义实验室科学家Binyuan Hui也发文告别,几人去向未明。