「跨会话进化」共找到 959 篇相关文章
中国团队首次在Nature子刊发布医疗AI标准,未来医生MedGPT摘得全球桂冠
中国AI医疗公司“未来医生”协同专家制定CSEDB,首次提出评估医疗大模型临床能力的系统性框架,被《npj Digital Medicine》收录。在其评估下,未来医生的MedGPT在主流大模型中夺冠。
注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案
Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。
1人顶1个Infra团队!OpenAI前CTO新招,让大模型训练跌成白菜价
大模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。
具身智能是泡沫还是前夜?两位学霸选择“上天”与“要脸” |5Y View
本期是五源合伙人孟醒与微分智飞高飞、首形科技胡宇航的对话。二人没选主流赛道,高飞要为飞行终端造‘具身大脑’,胡宇航给机器人‘脸面’,这是让机器人进化的尝试。
模型汤新做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷新SoTA!
大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。
5小时通关《原神》主线!Lumine:AI玩家正式登场
Lumine能像人类一样理解游戏画面、推理并操作,以接近人类效率5小时通关《原神》蒙德主线,还能零训练玩《鸣潮》等。它是开放式研发方案,靠少量数据和显卡让模型成强大智能体。
NIPS2025|小红书智创AIGC团队提出布局控制生成新算法InstanceAssemble
当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。
DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型
GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。
GraphRAG圈新秀:文档级RAKG
随着大模型能力增强,知识图谱成研究热点。传统KGC有实体消歧难、模式僵化等痛点。文章提出RAKG框架,将RAG评估机制引入知识图谱构建,实现文档级自动化构建与评估,多指标表现优异。
相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作
S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。