「世界建模」共找到 1124 篇相关文章
我国Chiplet产业的真实水位与全产业链突围
国内Chiplet市场快速增长,但与国际仍有差距。国家和地方给予政策与资金支持,多个联盟推动标准化。企业在设计、封测、EDA等领域积极布局,但面临核心技术、设计测试、产业链协作等挑战。
谷歌突砍Gemini免费版炸锅,数据养模遭背刺?GPT-5.2突袭Gemini 3,Demis Hassabis:谷歌须占最强位
近日谷歌收紧Gemini API免费层级限制,引发开发者不满。同时,OpenAI计划提前发布GPT - 5.2竞争。谷歌DeepMind的Hassabis表示要与OpenAI竞争到底,对Gemini 3满意,还介绍了谷歌未来三个主打方向。
DeepMind招募波士顿动力前CTO,哈萨比斯点赞宇树
据Wired报道,谷歌DeepMind聘请波士顿动力前CTO Aaron Saunders,他将解决物理世界实现AGI的硬件问题。这是谷歌机器人战略的人才回流,Hassabis想让Gemini成机器人操作系统,他看好宇树但更关注软件。
美团新独立APP,点不了菜只能点AI
美团新开源LongCat-Flash-Omni模型,支持多模态,在全模态基准测试达开源SOTA水准,推理快且全模态能力强。实测交互体验丝滑,其迭代逻辑清晰。该模型成功源于架构创新,美团靠软硬件结合实现虚实连接。
开源对机器人的价值,远超大模型时代的想象丨唐文斌深度对谈抱抱脸创始人
Dexmal联合创始人唐文斌与Hugging Face联合创始人Thomas Wolf指出当前机器人研究痛点,联合推出开放、统一、可复现的真实世界机器人评测平台RoboChallenge.ai,探讨开源对机器人的价值、评测平台搭建等问题。
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。
清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分新范式
音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。
强化学习之父:大语言模型走错了路,不符合「苦涩教训」精神
2024 年图灵奖得主、强化学习创始人之一 Richard Sutton 在播客中批评 LLM 发展方向,认为其无真正智能,违背「苦涩教训」原则,缺乏持续学习能力,仅模仿人类,未理解世界。此观点引发 AI 社区激烈讨论。
一图看透全球大模型!新智元十周年钜献,2025 ASI前沿趋势报告37页首发
新智元十周年峰会发布《2025新智元ASI前沿趋势报告》与《2025新智元ASI产业图谱》,预测2027达ASI临界,智能体全面爆发。报告展示全球大模型格局,中国开源模型表现亮眼,还揭晓了创新大奖。
唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力
大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。