「新推理模型」共找到 9817 篇相关文章
谷歌AlphaGenome登Nature封面!破译生命基因暗物质
Google DeepMind团队的AlphaGenome模型开源并登上Nature封面。它能以单碱基精度破译百万碱基对DNA序列调控密码,在多项基因组轨迹预测任务表现出色,还可用于疾病研究,虽有不足但潜力巨大。
小红书 AI 搜索负责人高龑确认出席 QCon 上海,分享小红书搜索的 LLM 进化之路
10月23 - 25日,QCon全球软件开发大会将在上海举办,聚焦多热门话题。小红书AI搜索负责人高龑将分享《从“搜内容”到“问AI”:小红书搜索的LLM进化之路》,介绍搜索实践及大模型应用经验。
2025 年 InfoQ 趋势报告:AI、ML 和数据工程
InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。
LeCun在Meta的最后一篇论文
LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。
“毋在浮沙筑高台”:汪源谈智能体想从 80 分跨到 90 分,全卡在上下文
前网易副总裁汪源在2026奇点智能产品大会分享,指出智能体系统瓶颈正从模型能力、Harness工程,转移到上下文。他还介绍了做好上下文基础设施的要点,以及推出的新内容格式KRL。
实测完豆包Seedream 4.5,替我设计师朋友哭了
火山引擎推出图像创作模型Doubao - Seedream - 4.5,有强化原图保持、多图组合生成、优化海报排版与Logo设计等主打点。经实测效果不错,已全量开放API并公测,官方还给出生图tips。
刚刚,DeepSeek扔出大杀器,梁文锋署名!暴力优化AI架构
2026新年第一天,DeepSeek发表梁文锋署名新论文,提出「mHC(流形约束超连接)」架构。它仅增约6.7%训练时间开销,就能让27B参数模型性能显著提升,还可能淘汰ResNet结构。
Bug变奖励:AI的小失误,揭开创造力真相!
最新研究发现,AI的「创造力」并非额外能力,而是架构副作用。扩散模型本应是复制机器,却画出奇怪图像。研究者基于规则构建数学系统,证明了这一观点,还推测人类灵感或许同理。
Harness Engineering又他妈是啥?
AI圈新词Harness Engineering引发关注。它类似给AI套缰绳,让其运转更高效。通过案例表明,模型非瓶颈,环境才关键。还介绍不同实现方式,指出命名有价值,最后探讨培养新人设计harness的问题。
清华、西交联合开源发布了Cheers : 一条更简洁、更高效的统一多模态路线
清华、西交联合开源发布CHEERS,提出面向统一多模态理解与生成的架构路线,在保持系统简洁前提下,统一理解与生成任务,继承开源预训练模型知识,在多项基准测试中表现优异,还实现4× token压缩。