「记忆评测基准」共找到 1797 篇相关文章
冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世
微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。
GPT-5的所有传言,以及,Sora 2?
OpenAI今晚1点举办直播,GPT - 5将亮相。发布前关键信息汇总,包括直播时长变长、GitHub泄露四个版本、三档定价策略、突破人类基准测试等,还或同步发布Sora 2。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。
真实物理加持,人物动画再也不像塑料人!UIUC华人让角色活起来了 | ICCV'25
PhysRig是UIUC与Stability AI联合提出的面向角色动画的可微物理绑定框架。它用物理建模替代传统绑定权重设计,解决传统LBS无法克服的问题,显著提升角色动画真实感,还适用于动作迁移任务。
飞书MCP不好用?我一天自研了人生教练MCP (v3.0)| 附:我的AI启发
作者因飞书MCP更新与期望不符,花一天自研人生教练MCP组件。介绍了人生教练Agent特点,还给出启动方法,最后分享在MCP实践中发现的AI趋势及实践总结。
谷歌AlphaGenome横空出世!40亿年生命代码一键破解,或再夺诺奖
谷歌DeepMind发布AlphaGenome,可一次读取100万个DNA碱基,预测基因突变。它以长DNA序列为输入,预测数千种分子特性,克服了现有模型在序列长度和分辨率间的取舍问题,有望推动生物学研究和新疗法诞生。
北大腾讯突破奖励模型瓶颈!让AI理解人类偏好,泛化能力比肩GPT-4.1
北京大学知识计算实验室联合腾讯等机构提出RewardAnything,突破奖励模型瓶颈。它让奖励模型理解自然语言评判原则,降低成本,泛化能力比肩GPT - 4.1,还能用于定制AI行为模式。
AI短片节创作者招募:在崇礼,用AI讲一个未来故事|甲子光年
「Future Now/未来此刻」2026夏季崇礼论坛将启幕,设立「Chongli AI Film Lab」专场论坛,发起AI短片节。面向全球创作者征集作品,有两大创作方向,生数科技Vidu全程支持,对作品有要求,还有丰厚奖励。
一个场景吃掉700MB显存!3DGS存储焦虑怎么解?这篇综述划了五个方向
过去三年,3D Gaussian Splatting(3DGS)成实时3D场景重建与新视角合成“默认答案”,但场景拓展后有显存、带宽和功耗限制。香港科大等联合发布综述,从底层数据流组织技术版图,给出优化建议和未来方向。
刚刚,Anthropic 宣布:Claude 自己长出了意识
Anthropic新研究《语言模型中的全局工作空间》,在Claude神经网络里找到特殊区域J - space,它有独特性质,对应全局工作空间理论。还介绍了发现方法及多个实验,探讨其与意识关系,研究已开源。