个性化更新」共找到 655 篇相关文章

算法论文8

大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练

字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位
开源动态8

YC掌门人60天写了60万行代码,一个人干20人的活,他把方法论全开源了

Y Combinator总裁Garry Tan 60天写超60万行代码,将方法论整合成开源工具gstack。它把Claude Code变成虚拟工程团队,含15个角色和6个增强工具,可并行运行多个Sprint,还具备多种实用能力。

AI寒武纪
新闻资讯7

郎园 Station Pet&Me|园区宠物友好再升级,以爱筑就人宠共生小天地

首创•郎园Station位于朝阳区东坝,是北京国际化潮流文化地标,2025年园区年度客流量450万人次。产业上,它运营AIGC视听产业创新中心,携手多家企业构建全产业链生态,影视后期制作企业占国内超60%份额。

郎园Station
推荐文章8

Claude Code 之父分享 10 大使用技巧

Claude Code 创造者 Boris Cherny 分享团队使用技巧,如并行工作、先规划再动手、更新 CLAUDE.md 等 10 条经验,还提及打造自动化体系、提升 Prompt 水平等内容,强调多用多想提效。

AGI Hunt
新闻资讯8

刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布旗舰模型Qwen3-Max-Thinking,总参数超1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升推理性能,该模型已可免费体验。

InfoQ
算法论文8

哈工大最新研究AI Meets Brain

传统大模型有“健忘”问题,哈工大《AI Meets Brain》研究借鉴人类记忆机制,为AI智能体打造强大记忆系统。研究涵盖核心洞察、记忆形态、分类框架等内容,还探讨了记忆赋能方式及未来发展方向。

CourseAI
算法论文8

微软:DeepSeek-R1等推理模型循环的原因找到了

前几天,DeepSeek - R1论文更新,披露诸多细节。重点是推理模型在低温/贪心解码下易循环,根源是学得不对,如风险规避式复读、时序相关错误复读,还给出解决方案。

PaperAgent
算法论文8

解决Agent幻觉:HaluMem精准定位记忆系统的“说谎”环节!

近年来,LLM和Agent在记忆管理上存在挑战,现有评估方法无法定位幻觉来源。论文提出HaluMem评估基准,通过三大任务和两个数据集揭示记忆系统幻觉行为,为开发可靠记忆机制提供指导。

深度学习自然语言处理
新闻资讯8

刚刚,OpenAI 发布 GPT‑5-Codex 新模型,专为编程而生

OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 新模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台大升级,集成 GitHub,保障安全隐私,还公布了定价与可用性。

AGI Hunt
新闻资讯7

微软痛失OpenAI 「独家」,七年绑定关系开始松动

微软与OpenAI达成新合作协议,微软对OpenAI模型和产品的知识产权许可变为非独占,有效期到2032年。这一调整为OpenAI将模型部署到其他云平台打开通道,双方合作关系更加灵活。

机器之心