「双重记忆路径」共找到 1111 篇相关文章
当代码遇上大模型:智能编程助手的架构设计与工程实践
在 InfoQ 举办的 QCon 全球软件开发大会上,字节跳动段潇涵介绍如何基于大语言模型构建智能编程助手。他分享实践经验,剖析研发痛点,介绍技术架构,还探讨未来发展方向,如认知增强、工具整合等。
这可能是Claude Code最重要的功能
Claude Code新功能Sub - agents很实用,能创建多个专精任务的Agent,有独立上下文窗口防‘记忆污染’,配置灵活,还能组成工作流。创建简单,比社区项目有优势,是Claude Code截至目前最重要功能。
Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密
Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。
AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河
在AICon全球人工智能开发与应用大会上,IDEA研究院张磊接受专访,剖析多模态智能体落地路径,分享工业界平衡研究与产品的见解,还为年轻人在AI浪潮中发展给出建议,指出底层系统能力是关键。
OpenAI首席科学家:发布前夜,我们差点砍掉ChatGPT!5个你不知道的惊险内幕。
文章分享OpenAI最新PodCast内幕。ChatGPT最初名又长又没记忆点,发布前夜高层因测试结果存争议。上线炸服,还曾因RLHF问题成“马屁精”。未来AI将向智能体化发展,招聘看重好奇心等能力。
数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?
论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。
ChatGPT化身生活操作系统:奥特曼预告下一代顶级AI
在旧金山AI初创学校对话中,奥特曼宣布OpenAI计划发布强大开源模型,可本地运行。还谈到模型成本下降、ChatGPT记忆功能,以及GPT - 5等集成模型愿景,甚至称高级订阅将免费送机器人。
数据「熵增」时代,AI 如何以标准重构治理秩序?
Agent热潮下数据分析与治理有短板,Gartner预测到2027年多数数据治理举措或失效。瓴羊Dataphin高级技术专家周鑫阐述以数据标准为核心的数据治理方法论及AI赋能自动化治理实践路径。
自定义轨迹驱动AI视频生成,ATI无需训练适配多种生成模型
字节提出视频生成运动控制统一框架ATI,通过轻量级运动注入器将用户定义轨迹投影至预训练图像 - 视频生成模型潜在空间,实现协调控制。用户指定关键点及路径控制运动,无需重新训练,适配不同架构。
图灵奖得主杨立昆现场追问:AI 还没越过这 3 道认知墙,谈什么通用智能?
图灵奖得主杨立昆指出AI未越过三道认知墙,即看不懂物理世界、无长时记忆、无推理结构,提出JEPA架构及AMI概念,还建议别卷模型,应卷架构,如探索具身智能等领域。