「π0.5模型」共找到 8819 篇相关文章
Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点
2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。
一个LoRA实现GPT-4o级图像编辑!浙大哈佛新模型冲上Hugging Face榜二
随着Gemini、GPT - 4o等把基于文本的图像编辑推向高峰,提高性能常需大量数据和大参数量模型。而浙大哈佛团队提出ICEdit,用少量数据和参数实现高质量图像编辑,媲美甚至超越商业大模型。
缩放定律Scaling正慢性死亡,算力收益递减,AI的下一个增长极是模型如何交互
前Google Brain科学家Sara Hooker论文指出,统治AI十年的缩放定律Scaling走向慢性死亡,算力收益递减,研究重点将转向推理时算力和模型如何交互,还分析了算力崇拜兴起、缩放法则裂痕及未来方向。
独家 | 乐聚发布垂域具身模型:一倍工业提效,两项榜单第一
AI科技评论独家获悉,乐聚机器人将推出面向工业场景的“垂域具身智能模型”——KUAVO VLA,该模型用600+小时真机数据进行中训练,能提效且减少适配与训练成本,两项指标排名第一,利好二次开发者。
阿里通义发布Z-Image非蒸馏版基础模型版本,支持完整CFG和负向提示
阿里通义发布Z-Image基础图像生成模型,采用单流扩散Transformer架构,具核心创新技术。它是非蒸馏模型,支持完整CFG和负向提示,注重输出多样性和创意控制,已在Hugging Face开放下载。
炸裂提速30倍!Meta提出REFRAF,无需改动模型,让RAG告别冗余与等待
近年来,RAG任务在提升模型回答质量的同时带来性能代价,Meta等团队合作提出REFRAG框架。它将无关段落压缩,引入强化学习选关键段落,实现高达30.85倍的TTFT加速,且无需改模型结构,实用性强。
AI不一定要“聊天”,OpenAI前研究员研发只做决策的模型,绕开文本生成,响应速度快200倍
本文报道前OpenAI研究员Diogo Almeida离职创业,推出不做文本生成、只输出结构化决策的新AI模型Jev,公开性能数据,探讨大模型应用分工新路线。
谷歌突袭发布AI应用,无需Wi-Fi、手机就能跑大模型!网友实测两极分化
谷歌推出 Google AI Edge Gallery 应用,可让用户在 Android 设备离线运行 AI 模型。它有响应快、隐私性好等优点,但网友实测评价不一,还有人认为它落后于苹果 CoreML。
刚刚,阿里发布最强推理模型Qwen3-2507,用疯狂一周暴击美国AI行动计划!
美国发布AI行动计划,欲成“世界AI冠军”,但阿里在7月22 - 25日三连发,推出Qwen3 - 235B非思考版本、Qwen3 - Coder、Qwen3 - 235B - A22B - Thinking - 2507推理模型,冲击美国计划。千问3在多领域表现出色,不过也有使用费用等小问题。
68页论文再锤大模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩
《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数大厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被大量静默弃用等,研究团队给出改进建议,官方也进行了回应。