「长上下文能力」共找到 4053 篇相关文章
ICML 2025|如何凭「自动补全」实现100K生成3×加速?
在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。
LLM的“记忆外挂”来了!Supermemory新API:一行代码让LLM记忆“无限+省钱90%”
Supermemory公司发布Infinite Chat API,能让任何LLM有近乎无限上下文长度。用户一行代码就能切换,可扩展上下文、省90%成本、提性能,已上线,有免费试用额度,后续有固定费用和用量计费。
让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务
手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。
原生Agent杀入画布!一站式搞定专业创作,全程可控、不抽卡
国内RunningHub平台推出原生AI智能体全能内容创作平台RHTV,它能一站式搞定专业创作,流程可控。实测显示,它能编排短剧、生成商用物料,还内置影视级工具,且依托庞大生态,能力无上限。
Anthropic最新论文:检测LLM内省意识的方法
Anthropic与MIT等研究表明,LLM能‘感知’被注入的steering vector,‘内省意识’在DPO等后训练阶段涌现。研究构建实验,发现内省能力行为稳健、检测非简单线性关联等,还揭示检测与识别机制不同及两阶段电路。
OpenAI 推出 gpt-realtime:语音智能体进入“秒回”时代,开发者直呼交互更自然
OpenAI 发布语音对语音模型 gpt - realtime,开放 Realtime API。其结合可端到端处理语音,缩短响应时间。模型语音质量、理解能力、函数调用能力提升,API 全面升级,多家企业已试点,还强化了安全措施。
最窒息的Bug:Agent循环搜索原地打转?SGR Agent用「双阶段认知」破局
Hybrid Schema - Guided Reasoning(SGR)是革命性AI研究智能体框架,用「两阶段推理 - 执行架构」和「持久化上下文记忆系统」,解决AI助手复杂研究任务的三大痛点,模拟人类研究过程,适用于多场景。
两张图定位全球,o3碾压T0级高手!人类「诡计」被看穿,跨模态推理爆表
OpenAI的o3在GeoGuessr游戏中与大师级玩家Sam Patterson对决,o3通过视觉与搜索推理,忽略伪造EXIF信息,最终以23179比22054获胜,展现出跨模态推理潜力,引发对AI推理能力的思考。
忘掉《Her》吧,《记忆碎片》才是 LLM Agent 的必修课
文章把电影《记忆碎片》主角莱纳德看作真人版 Agent,结合情节拆解 Agent 上下文工程知识。阐述 Agent 取代 Chatbot 成行业主流,借莱纳德记忆系统说明上下文工程支柱,还指出 Agent 设计漏洞及需反思模块。
独家专访临界点CEO乔天杰:机器人运动会7冠背后,灵巧手真正该比什么?|甲子光年
8月22 - 26日,第二届世界人形机器人运动会举行,灵巧手首次单独参赛。临界点携OmniHand获7金4银3铜,CEO乔天杰接受专访,探讨灵巧手能力衡量、自由度、工程化及产业应用等问题。