「六层上下文架构」共找到 2362 篇相关文章
阿里巴巴新论文:让LLM学会管理记忆,告别人工规则
大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。
DeepSeek V4爆春节登场!四大杀招突袭全球编程王座,Claude危
据爆料,DeepSeek计划在2月中旬春节前后发布V4模型,剑指编程王座。其在编程能力、超长上下文代码处理、算法提升、推理能力上有突破,或延续高性价比路线,在受限硬件下靠算法取胜。
英伟达、英特尔和AMD芯片同台竞技:CES 2026各自都展示了怎样的实力
全球最大消费电子展CES 2026上,英伟达、英特尔和AMD发布新品,AI算力芯片竞争演变为平台架构全面战争。英伟达推Rubin计算平台,英特尔发布第三代酷睿Ultra系列,AMD展示Helios平台及相关产品。
告别「手搓Prompt」,前美团高管创业,要让物理世界直接成为AI提示词
在2025年AI硬件赛道火热背景下,Looki创始人孙洋团队打造Looki L1可穿戴设备,将自动驾驶逻辑用于生活场景,转化视听信号为模型上下文,构建用户专属数据飞轮,让AI实现主动共鸣。
OpenAI:如何用 Codex 在 28 天内极速打造安卓版 Sora
OpenAI发布工程博客,揭秘用Codex不到一个月打造Sora安卓版应用的过程。这款应用上线首日冲至Google Play下载榜第一,24小时内用户生成超百万视频,开发过程耗约50亿tokens,崩溃率仅0.1%。
AI鸿沟正在拉大!OpenAI报告揭示:不用AI的企业将被淘汰
12月8日OpenAI发布2025年报告,基于百万级企业客户数据,揭示企业AI使用量爆发式增长,重塑全球商业流与组织架构。不同行业、地域加速渗透,同时企业和员工间AI鸿沟也在拉大。
DeepSeek V3到V3.2的进化之路,一文看全
知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。
X爆火Overleaf科研辅助神奇PaperDebugger
当下学术写作借助大语言模型辅助时,流程繁琐且上下文易丢失。新加坡国立大学团队推出的 PaperDebugger 是基于插件的多智能体系统,寄生在 Overleaf 编辑器内,可完成多任务,解决现有工具不足。
从补全到 Agentic Edit:Trae 在代码编辑上的落地与进化
AI 编程助手走向智能化,Trae 团队历经“补全 + Chat → Apply → Builder + Cue”三阶段,解决文件定位、跨文件修改等难题,介绍 Apply 与 Search/Replace 方案适用场景,还将从三方面继续探索。
刚刚,霸榜神秘视频模型身份揭晓,原来它就是「David」
几天前登上Artificial Analysis榜首的神秘视频模型揭晓,是Runway最新发布的Gen - 4.5。它树立行业新标杆,在多方面表现出色,但也存在一些视频模型常见的局限性,Runway正探索解决办法。