多阶段训练」共找到 6019 篇相关文章

算法论文8

挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026

IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。

AI科技评论
新闻资讯7

星海图高继扬:具身智能下半场,应用为王

星海图CEO高继扬在AGI Playground大会分享具身智能观点,认为2026年是下半场,核心是应用。具身智能发展慢因缺高质量数据和合适本体,未来产品形态或为‘整机+预训练模型+后训练工具’,下游将形成大生态。

Founder Park
算法论文7

一篇模态大模型推理技术最新综述

华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及模态大模型推理方面内容。

PaperAgent
算法论文7

苹果提出原生模态Scaling Law!早融合+MoE,性能飙升秘密武器

如今打造强大模态模型是AI重要目标,常用方法有局限。法国索邦大学、苹果研究人员开展原生模态Scaling Laws研究,对比早融合与后融合,探讨种因素对模型性能影响,发现早融合、模态MoE优势,为后续研究指明方向。

新智元
产品应用7

出了两道真题考 GLM-5.2,Opus 4.8 和GPT 5.5 陪跑

作者对GLM - 5.2、Opus 4.8和GPT 5.5进行两项测试。一是审计Skill体系,GLM - 5.2覆盖skill数、找出冲突,还挖出bug;二是做世界杯夺冠推演器网站,Opus表现出色,GLM - 5.2省token,Codex有巧思但结构有缺陷。

AI产品黄叔
产品应用7

三个理想火枪手创业,打破具身最快百台交付纪录

至简动力由理想智驾团队三位核心负责人创立,7月6日宣布首款全场景机器人i7 Pro完成首批百台交付,创下具身智能行业最快纪录。其与绿的谐波子公司合作落地全球首个CNC智能化具身机器人产线,i7 Pro还进入场景。公司计划进入领域,将发布新品。

量子位
6

ChatGPT 的10种快速变现方法

探索ChatGPT的变现潜力,这篇文章列出了10种方法,从账号销售到内容站点建设,覆盖了个层面的商业应用。

我是哥飞
新闻资讯7

胡俊杰、吴佳俊、刘子纬等获奖,微软学者奖学金公布

2026 年微软学者奖学金名单公布,获奖者研究聚焦面向全球与社会影响的人工智能等前沿领域,项目汇聚创新社区推动协同演进,还介绍了入选的华人学者及其研究方向。

机器之心
开源动态8

3.9K Star!Inkeep 把 AI 原生 Markdown 编辑器做成了开源项目!

Inkeep 团队开源 OpenKnowledge,这是真正为 AI 设计的知识库工具,已获 3.9K Star。它有所见即所得、AI 协作等亮点,还基于 Git 同步,保障数据安全,值得 Markdown 工具使用者关注。

开源星探
产品应用7

微信聊天记录喂AI(腾讯官方版)

用户可将微信聊天记录转发到元宝app,它能提供智能总结、分析等服务。在工作、生活、学习全场景都适用,如生成会议纪要、梳理旅游规划等,此前它还能总结微信文件、解读公众号文章。

量子位