跨镜头记忆机制」共找到 1358 篇相关文章

算法论文8

让大模型学会“像人一样”查证真伪

伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“在线查证”新范式。它借助在线强化学习、精细化奖励机制和高质量数据,让模型学会像人一样查证,在多数据集上表现出色。

深度学习自然语言处理
新闻资讯7

OpenAI离职员工自曝:干了一年就润了!007压力逼到极限,AGI成宗教

OpenAI离职员工Calvin French - Owen揭秘公司文化。OpenAI扩张快致机制常调整,靠Slack运转,推崇实力至上、行动导向。Codex从想法到上线仅7周,虽辛苦但成果惊人,还分享了公司在安全、代码等方面情况。

新智元
推荐文章8

深度解析 Claude Code 在 Prompt / Context / Harness 的设计与实践

本文深度解析Claude Code在Prompt、Context、Harness三方面的设计与实践。介绍了Prompt动态组装过程,探讨CLAUDE.md项目说明、上下文压缩体系和记忆系统,还阐述了系统级提醒、多Agent及安全体系等内容,文末分享了项目有趣彩蛋。

阿里云开发者
产品应用7

OPPO新AI操作系统,走出屏幕“指哪答哪”,嘈杂环境只听你声音

OPPO新一代AIOS ColorOS 16来了,“一键闪记”和“一键问屏”功能有新玩法。“一键闪记”能记取餐码等,还会“记忆共生”;“一键问屏”走出屏幕,嘈杂环境也能只听你声音。此外,OPPO宣布全新AI技术架构。

量子位
算法论文8

Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限

加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。

机器之心
产品应用7

如何让AI帮你做前端自动化测试?我们这样落地了

本文介绍阿里基于AI的UI自动化测试框架在专有云质量保障的实践。框架用开源browser - use等工具,采用自然语言驱动用例、动态元素定位等机制,还应对了大模型幻觉等挑战,也提及构建企业级数据分析Agent方案。

阿里云开发者
推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制的转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。

AI科技评论
新闻资讯8

从工具到生命形式:OpenClaw 引发的 Agent 再思考

InfoQ《极客有约》X QCon 直播邀业内专家探讨 OpenClaw 落地难点。专家认为,这波 Agent 热潮验证了复杂工作可被系统承接,也指出 OpenClaw 虽非生产级产品,但推动了全民 Agent 浪潮,同时探讨了模型与编排层结合、记忆系统等问题。

AI前线
推荐文章7

万字长文!大模型LLM推理优化技术总结

文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。

OpenMMLab
开源动态7

SGLang JIT Kernel 介绍

文章介绍SGLang JIT Kernel,此前开发CUDA Kernel流程繁琐、编译时间长,现基于TVM - FFI探索JIT开发加速迭代。文中梳理其机制、抽象及新增Kernel流程,还给出环境设置、目录结构等内容,并以实例说明开发过程。

GiantPandaLLM