长上下文问题」共找到 4089 篇相关文章

推荐文章7

他们还没毕业,就在用AI搭建自己的世界|五源小酒馆Vol.30 x AI Native创造者

本期五源小酒馆邀请三位年轻AI Native创造者,分享AI学习与创造经历。他们谈及AI对生活工作的改变、关注的产品及模型,探讨资源分配、AGI突破等问题,还交流了未来能力培养和给十年后自己的话。

五源资本 5Y Capital
新闻资讯7

AI 时代的人们,正在两极分化

文章指出人们对AI的认知正出现巨大裂缝,Karpathy将人分为两拨,一拨用免费版ChatGPT后认为AI不过如此,另一拨花高价订阅前沿模型感受其惊人进步。不同用户群体使用的AI能力代差大,还提及使用时维度。

AGI Hunt
算法论文8

让大模型上车:理想汽车硬件协同设计算出最佳边缘模型

三角洲AI实验室、中科院、理想汽车等找到大语言模型硬件协同设计寻优之路,在相同延迟下降低端侧模型困惑度,压缩模型架构挑选时间。研究揭示缩放定律,打造硬件感知建模框架,找到精度与延迟最优解。

AIGC开放社区
开源动态7

小米MiMo Agent 跨会话进化

多数AI编程Agent任务一就忘事,业界主流靠堆上下文窗口应对,但有缺陷。小米MiMo团队开源的MiMo Code,靠显式存储 - 检索机制,200步以上任务胜率超Claude Code达65%,介绍了其设计及优缺点。

CourseAI
开源动态8

6行代码搞定AI Agent记忆!这个16K Star的开源项目打破了传统RAG痛点!

传统RAG方案有上下文断裂、检索不精准等问题,而开源项目Cognee用6行代码就能给AI Agent构建持久化记忆系统。它结合向量搜索和图数据库,形成统一记忆层,支持30+数据源,有多种核心API。

开源星探
算法论文8

CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍

随着高分辨率图像与视频处理需求增,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。

机器之心
推荐文章7

Agent 真正的护城河,正在从工具转向记忆资产

2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索推到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。

Founder Park
产品应用8

终于,TRAE SOLO全量开放,我们用它复刻了PewDiePie的大模型智囊团

2025年AI Coding赛道上,TRAE是国产AI IDE代表作。7月其SOLO Beta版反响好,如今正式版全量推送。它定位为‘具备响应感知的编程智能体’,新增功能,还限时免费体验,实测显示开发能力强。

机器之心
新闻资讯8

对话淘宝姜宇宁:如果你只推低价商品,是不需要用大语言模型的

淘宝姜宇宁团队上线RecGPT百亿参数推荐大模型,对“猜你喜欢”功能技术升级。大模型赋予传统推荐系统新能力,如让其“白盒化”、理解上下文等。姜宇宁认为AI要创造商业价值,落到业务场景形成正向循环。

AI科技评论
新闻资讯8

硬核「吵」了30分钟:这场大模型圆桌,把AI行业的分歧说透了

在WAIC 2025大模型论坛的“模型之问”圆桌中,多位行业大佬围绕大模型展开辩论,话题涉及训练范式、模型架构、数据、开闭源等核心问题,不同观点碰撞,深入探讨大模型技术演进与发展之路。

机器之心