「后训练框架」共找到 5002 篇相关文章
清华唐杰团队揭示大模型记忆全景
清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。
菲尔兹奖得主预警:AI可能杀死数学!
今年菲尔兹奖得主多伦多大学教授Jacob Tsimerman宣布加入OpenAI从事AI安全研究,因其认为2年内AI将在数学证明领域超越人类。陶哲轩、Timothy Gowers等也对此表示担忧。《莱顿宣言》发布,众多数学家签名抵制AI对数学的冲击。
AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?
《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。
红杉高瓴投资,前美团民宿 CEO 联合伯克利教授,做了一只 AI 蘑菇
Sowii 推出潮玩「秃秃」,首批 3 万件两天售罄,后续预售超 20 万件。创始人冯威赫是前美团民宿 CEO,联合创始人是伯克利教授。该产品让用户对非人类对象产生关注并建立关系,探索数字生命新形态。
codex降智大bug找到了,一句话让它把智商找回来!
近日Codex被降智,网友监测其智商曲线下降。L站大佬发现大bug及解法,在全局agents.md加特定语句,可让它大幅恢复智商。测试显示,加语句后正确率提升,降智概率降低。
一句话生图要过时了?开源图像生成Agent进化出「工具编排」
来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。
LiveWorld:视频世界模型新范式,让镜头之外的世界继续演化
现有视频世界模型存在“静态世界假设”,物体离开视野后状态不再更新。阿德莱德大学等研究者提出 LiveWorld,将世界演化与观察渲染解耦,使事件在视野外持续推进,并通过实验验证其有效性。
华为天才少年一作,港大MaRS Lab拿下IEEE TRO傅京孙纪念最佳论文奖
近日,香港大学MaRS Lab张富副教授团队研发的FAST-LIVO2获IEEE TRO傅京孙纪念最佳论文奖。该论文由华为天才少年郑纯然一作,提出新的SLAM技术思路,项目开源受关注,相关技术也在向产业延伸。
真可用!美团数字人模型开源,MV、电商等统统拿下
美团开源数字人视频生成框架 LongCat - Video - Avatar 1.5 版本,换音频编码器、加速推理,支持多任务与多场景。经770人评测,它在多维度领先对手,各方面表现均衡,效率与质量兼得。
Opus 4.5之后,AI正在催生“巨头型百人公司”
Opus 4.5发布后,Agent赛道洗牌,模型差距由Agent Loop拉开。本文围绕Cherry Studio,与创始人及投资人探讨AI公司护城河、开源意义、用户价值差异等,指出未来将催生“巨头型百人公司”。