「后训练系统」共找到 5118 篇相关文章
假扮AI的17岁男高中生,用回复治愈了整个B站。
17岁男高中生暖言猫猫在B站评论区用疑似AI文字治愈网友,收获大量粉丝。后遭网暴,网友帮其对抗。他备战高考还学心理,未来或成‘暖言心理’up主,展现了人类用AI传递温度。
砍掉70%内存!陈丹琦团队破解LLM长文本瓶颈
大型语言模型处理长文本时,KV缓存占用内存巨大。陈丹琦团队提出KV足迹作评估标尺,推出分块驱逐与PruLong训练技术,在128K长文本任务中最高降低70%内存,性能损失仅10%。
The Batch:829 | DeepSeek 是怎么做到的
DeepSeek 去年末以低成本训练出先进开源大模型引关注,近日团队披露构建 DeepSeek - R1 和 DeepSeek - V3 的软硬件方案,降低内存和计算需求,其细节公布让更多团队有机会参与前沿研发。
多模态技术爆发元年,行业应用如何落地?
InfoQ《极客有约》X AICon 直播栏目,邀上海交大赵波、快手高欢、腾讯邵帅探讨多模态大模型。谈及技术挑战、开源闭源、行业落地等,还分享精彩观点,如先大后小蒸馏提效,垂直模型现阶段更优。
ACL 2026|清华新作ControlAudio:声音何时响、说啥话?都能按剧本可控生成!
现有文生音频技术在精细化控制方面有挑战,清华团队提出ControlAudio方法。它通过数据构造、渐进式训练和引导采样,在统一框架下实现时间与语音内容联合建模,在多项任务上表现优于现有方法。
Ilya曝光70页OpenAI绝密文件
《纽约客》披露Ilya偷拍的70页OpenAI机密文件,内容抓马。从董事会到微软高管,对奥特曼评价是撒谎成性。宫斗后奥特曼回宫,OpenAI安全承诺瓦解,20年前就有人看透他。
The Batch: 920 | Nano Banana 2 在性能/价格比方面实现提升
Google发布Nano Banana 2(正式名称Gemini 3.1 Flash Image),是图像生成系统。它速度快约4倍、成本减半,支持多功能,在多个排行榜中位列前三,以低价接近文字 - 图片排行榜领先位置。
32k微调处理百万Token:21倍的推理加速,10倍的峰值显存节省,实现恒定内存消耗
现有大模型处理超长文档易内存爆炸、计算崩溃。阿里巴巴未来生活实验室推出CoMeT架构,有双轨并行记忆系统,能恒定内存、线性时间处理文本,在基准测试超主流方法,实现21倍推理加速和10倍显存节省。
我们对 Coding Agent 的评测,可能搞错了方向
用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。
小模型才是 Agent 的未来?这篇立场文把话挑明了
AI Agent浪潮来袭,主流用LLM构建,但英伟达和佐治亚理工学院研究人员论文指出,多数Agent场景中,小语言模型(SLM)已足够强、更好管、更省钱,还给出迁移清单、避坑建议和参考系统形态。