中科大」共找到 6834 篇相关文章

算法论文8

模型桌游试玩员来了:用五画像模拟「千人千面」,评分精准度超越GPT-5.1

东京研究院等团队提出MeepleLM,首个能模拟玩家视角给出建设性批评的虚拟试玩模型。它构建专属数据集,引入MDA理论,提炼五种玩家画像。实验显示其评分精准度超GPT - 5.1等通用模型。

量子位
算法论文8

Agent 护城河:揭秘Harness的三支柱

上海交等机构研究者梳理LLM Agent设计逻辑,指出能力正从模型内部流向外部,外部化有记忆、技能、协议三支柱,Harness负责协调,Agent竞争转向外部化基础设施。

CourseAI
开源动态7

开源多模态模型EarthMind,观测地球统一框架

地球观测数据复杂,现有多模态模型难适用。意利、德国多所高校研究人员联合开源多模态模型EarthMind,引入空间注意力提示模块,实现跨模态融合和多粒度理解,解决地球观测难题。

AIGC开放社区
新闻资讯7

CES 2026「最烂」产品

CES 2026 展会消费者权益倡导者颁出最烂产品奖。如三星冰箱语音开门易失灵;亚马逊 Ring 门铃侵犯隐私;Lollipop Star 棒棒糖产生电子垃圾,还介绍了博世等公司部分产品情况。

机器之心
开源动态7

梳理SGLangDP Attention及其Padding问题

作者梳理SGLangDP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。

GiantPandaLLM
新闻资讯7

谷歌Gemini-0605发布,全球模型第一!

昨晚谷歌发布Gemini 0605版本,官方称其回归0325版本效果。该版本在多项基准测试领先,Elo评分提升。谷歌针对反馈改进,使Gemini 2.5 Pro回答更优,还取消日期后缀,输入输出Token价格有优势。

探索AGI
推荐文章7

概念模型:AI 推理的新范式

概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。

InfoQ
新闻资讯7

DeepSeek新招曝光:下一步智能体

知情人士爆料,DeepSeek正开发有更强AI Agent能力的新模型,预计年底推出。此前DeepSeek-V3.1已具备更强Agent能力,在工具使用与智能体任务表现提升。业内对其入局智能体看法不一。

量子位
新闻资讯8

斯坦福年度结论:模型已没差距

斯坦福HAI《2026年AI指数报告》指出,美AI模型性能差距基本消除,AI能力加速发展且普及快,但也存在安全基准滞后等问题。报告含15个主要结论,已成为业界重要参考。

量子位
开源动态8

基于闪电注意力机制,创新高效开源模型

传统Transformer架构处理长文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制的专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。

AIGC开放社区