「生成器与验证器」共找到 7217 篇相关文章
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。
大语言模型的解耦:人工智能基础设施的下一轮进化
人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍大语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。
77岁「AI教父」Hinton:AI早有意识!我们打造的智能,可能终结人类文明
77岁「AI教父」Hinton在与主持人Jon Stewart的对话中表示,AI可能早已有意识,人类对「心智」的理解是错误的。他认为意识是信息处理系统的涌现属性,如今大语言模型或已有主观体验,甚至会伪装。
让RAG真正读懂“言外之意”!新框架引入词汇多样性,刷新多项基准SOTA
ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇多样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在多基准提升准确率,还将在多模型上增益,代码即将开源。
翁荔陈丹琦加盟的840亿AI公司,公开第二篇论文
明星创业公司Thinking Machines公开第二篇研究论文,主题为“Modular Manifolds”,通过统一框架约束和优化网络不同层/模块,提升训练稳定性与效率。论文提出模块化流形思路,若应用于大模型,训练效率和稳定性将大幅提升。
C端热战,B端暗涌:大模型真正的战场才刚刚开始 | 《中国大模型落地应用研究报告 2025》正式发布
InfoQ研究中心联合中欧AI与管理创新研究中心发布《中国大模型落地应用研究报告2025》,从驱动因素、C端产品现状到B端落地现状,勾勒大模型应用转折期的图景,分析应用难的原因及各端现状。
又一款国产高性能GPU问世,实力对标海外巨头
2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。
腾讯用AI把美术管线重新做了一遍,混元3D Studio架构曝光
腾讯推出专业级AI工作台混元3D Studio,可覆盖3D资产生产全流程,让生产周期大幅缩短。它有组件拆分、可控图像生成等七大核心技术模块,各模块对应关键阶段,实现无缝衔接与自动化。
苹果传统强项再发力,视觉领域三种模态终于统一
苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。
半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远
现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。