「AI世界模型」共找到 13776 篇相关文章
谷歌Genie3全网玩疯!画质飞跃720P,网友造出西幻RPG游戏
谷歌世界模型Genie3发布仅7个多月就有巨大进化,画质达720P,体验时间拉长,世界类型丰富。它玩法多样,能体验极限运动、亲近自然、穿越时空等,网友还用它造西幻RPG游戏。
刚刚,OpenAI在ICPC 2025编程赛上满分登顶,Gemini也达到金牌水平
在ICPC 2025编程赛上,OpenAI 5小时内解决12个问题满分登顶,其由通用推理模型集成体构成,结合GPT - 5与实验性模型;Gemini解决10个问题达金牌水平,在部分难题表现出色。
Meta 系 95 后华人明星团队,创业一年就与高通达成合作,让手机拥有多模态记忆
由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,能降低延迟、确保数据安全等。
5Y View|欢迎来到评测时代
强化学习推动AI突破,模型将刷爆既有评测,AI实验室面临评测饥荒。构建评测与RL环境是利用人类时间的高效方式,不同领域有不同验证方式,Mercor已率先拓展RL数据边界。
刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板
DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。
CVPR 2026 Highlight|让家电「在仿真中运转起来」,北大正式发布RealAppliance!
北京大学团队提出 RealAppliance 数据集与 RealAppliance - Bench 评测基准。前者收录 100 个精细家电资产,与真实产品系统多层面对齐;后者围绕五项任务评估模型家电操作规划能力,实验显示主流模型仍面临挑战。
LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%
最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。
最新!Karpathy:Vibe Coding只是抬高了地板,真正的战场在这里
Andrej Karpathy在AI Ascent 2026上与红杉合伙人对话,分享自提出“vibe coding”一年来的变化。谈到技术转变、Software 3.0、模型“锯齿状”特征等,还区分了vibe coding和agentic engineering,指出人类需保留品味、判断力等。
从兼职工程师直接跳到CTO,他用两个月让一款 Agent 干掉60%复杂工作并放话:“代码质量与产品成功没有直接关系”!
金融科技公司 Block 的 CTO Dhanji R. Prasanna 分享公司 AI 转型经验。Block 在 8 周内部署 AI 智能体,推出开源 AI Agent 框架 Goose,能节省员工工时,还谈到组织变革、AI 应用及招聘等多方面见解。
诺奖、金牌与SOTA:谷歌2025八大领域核心突破年终回顾
2025年是AI成为社会基础能源的关键转折点,谷歌通过全栈自研与生态标准双轮驱动构建智能基础设施帝国。从模型推理到科学发现领域均有突破,如Gemini 3系列、Ironwood芯片等,还在各领域有诸多应用与探索。