中智行」共找到 2626 篇相关文章

算法论文8

大模型再爆弱点!旧记忆忘不掉,新记忆分不出,准确率暴降 | ICML'25

弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。

新智元
推荐文章8

AI智能体的上下文工程:Manus的构建心得

季逸超在文章分享了 Manus 构建 AI 智能代理的心得,包括围绕 KV 缓存设计、使用掩码管理工具、将文件系统作上下文等内容,还指出要保留错误信息、避免小样本带偏等。

AI工程化
7

人类选手苦战10小时获得世界编程冠军,OpenAI获得亚军,但这可能是最后一次了

在AtCoder启发式编程世界杯总决赛,人类选手Psyho苦战10小时击败OpenAI的AHC模型夺冠。赛事专注优化问题,比赛过程跌宕起伏,也证明了AHC具备持续性推理等关键能力。

AI寒武纪
产品应用8

刚刚,奥特曼放出ChatGPT「统一智能体」!惊呼真AGI,最卷打工人来了

奥特曼带队直播发布ChatGPT agent,它融合三大技术优势,可自主工作,还能上网直出PPT、Excel。在多项测试刷新SOTA,2025年将成全新AI杠杆,解锁「超级个体」模式。

新智元
开源动态8

基于闪电注意力机制,创新高效开源大模型

传统Transformer架构处理长文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制的专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。

AIGC开放社区
推荐文章7

CUTLASS CuTe GEMM细节分析(一)——ldmatrix的选择

作者作为CUTLASS CuTe初学者,记录问题分析过程。本文聚焦如何基于TiledMMA及输入矩阵在Shared Memory上的Layout选合适Copy Operation完成拷贝,结合实例讲解ldmatrix指令选择,还给出参考代码。

GiantPandaLLM
推荐文章7

LLM提示三剑客:解密CoT、ReAct、DSP如何提升AI准确率?

LLM提示分思维链(CoT)、ReAct和声明式自我提示(DSP)三类。CoT鼓励模型推理,适合多步骤复杂问题;ReAct结合推理与动作,是代理基础;DSP让模型声明计划,用于模块化任务。还给出使用场景与对比。

CourseAI
算法论文8

长思维链里的推理步骤,哪些最关键?三招锁定LLM的「命门句子」

杜克大学和 Alphabet 研究者提出在句子层面分析推理痕迹,找出长思维链关键步骤,提高 LLM 可解释性等。提出三种互补方法,还提供开源工具,研究为调试推理失败等提供可能。

机器之心
产品应用7

飞书MCP不好用?我一天自研了人生教练MCP (v3.0)| 附:我的AI启发

作者因飞书MCP更新与期望不符,花一天自研人生教练MCP组件。介绍了人生教练Agent特点,还给出启动方法,最后分享在MCP实践发现的AI趋势及实践总结。

AI 产品自由
推荐文章7

2025-06 - 念头通达(月度小结)

作者 2025 年 6 月月度小结,称不再想读博、不追求研究工作,认为有让人幸福的工作。工作上 Agent 落地有收益,探讨平台化提效,还分享选业务的乐观心态,也提及消费和做视频情况。

chaofa用代码打点酱油