「长上下文大语言模型」共找到 8329 篇相关文章

算法论文8

清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
8

挺意外的,Agent长期记忆潜力被AMemGym挖出来了

论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。

PaperAgent
推荐文章8

AI 原生研发范式:从“代码中心”到“文档驱动”的演进

文章讲述AI编程时代,用SDD解决上下文腐烂、审查瘫痪、维护断层问题,并提供人机协作SOP。介绍SDD理念、实操流程、团队协作方式,还提及资产沉淀、风险防范和常见问题解答,助力研发高效转型。

阿里云开发者
产品应用8

5年博士1年读完,20分钟干完48小时教授工作!这个工具在硅谷火了

新智元报道,Claude Code正重新定义编程。顶级开发者用它写代码,零基础小白10分钟做出App,教授20分钟完成48小时工作量。它理解项目上下文,自动设计、生成、测试代码,普通人用自然语言提需求即可。

新智元
开源动态8

X 推荐算法开源,暴力拆解推荐机制,这是内容创作者的终极流量增长秘籍。

马斯克兑现承诺,将X推荐算法开源。文章用通俗语言介绍其运作原理,把推荐系统比喻成两个‘内容买手’和一个‘裁判’,还给出内容评分标准、过滤机制及创作者提升流量的实战建议。

开源AI项目落地
产品应用8

摩尔线程AIBOOK一周实测:开箱即训的「AI Native」体验

摩尔线程AI算力本MTT AIBOOK专为AI学习与开发者打造。它搭载「长江」芯片,提供50TOPS异构AI算力,运行MT AIOS系统,预置完整AI开发环境。实测显示其部署简单,性能出色,还具备端云一体等优势。

新智元
新闻资讯7

2026年OpenAI最看好的3个方向

OpenAI首席财务官与投资人聊2026年AI趋势,涉及多智能体登场、算力换收入、大模型能力突破等。还谈到对医疗、具身智能行业变革影响,破除AI泡沫说法,预测机器人行业前景等。

量子位
新闻资讯8

从「偶然发现」走向「必然创造」:AI如何重塑生物制造全链路?

2026年1月9日“第四届合成生物学及生物制造大会”上,深圳瑞德林李加忠指出AI4S驱动合成生物学变革,从“经验驱动”变为“数据与逻辑驱动”,并分享瑞德林通过AI4S重塑生物制造全链路的实践。

AI科技评论
新闻资讯7

WASI 1.0:WebAssembly可能在2026年悄然普及

WebAssembly在Wasm 3.0和组件模型发布后进展巨大,预计WASI 0.3.0在2026年发布将使其成熟落地,可在多场景替代传统容器,还介绍了其优势、关键特性及标准化情况。

InfoQ
算法论文8

CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?

论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三大悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。

深度学习自然语言处理