「模型突破」共找到 8231 篇相关文章
都说记忆是Agent标配,但MemSyco发现漏算了一件事
厦门大学与吉林大学的最新研究指出,随着大模型Agent具备长期记忆,虽成为“长期协作者”,但也出现Memory-Induced Sycophancy问题。为此提出MemSyco - Bench评测基准,经实验得出多项发现,指出Agent Memory关键瓶颈转变。
实锤!GPT-5.5「降智」被抓,OpenAI官方文档认了
近期,网友发现GPT - 5.5使用一两个小时后突然变傻、质量下降,开发者经测试实锤系统会静默切换模型。Plus和Pro用户均受影响,此前GPT各版本升级也常引发“降智争议”。
全行业的「龙虾热」中,什么是AI Infra下半场的「神之一手」?
OpenClaw爆火,标志AI进入「自主执行时代」,但面临安全、资源利用和并发规模等挑战。腾讯云Agent Runtime为企业级AI智能体打造专业支持,解决状态管理和行为治理难题,还助力MiniMax突破性能瓶颈。
火爆全网的《卢浮宫小猫》AI视频万字创作心得分享,这可能是他们最毫无保留的一次。
数字艺术家海辛和阿文分享《卢浮宫小猫》AI视频全流程创作心得,从选角、定调、音乐、分镜、美术到动画等环节,还提及废稿情况,强调模型便捷不应成偷懒理由,要把作品做得更好。
规范驱动开发:让架构变得可执行
文章介绍规范驱动开发(SDD),它是软件架构重大转变,以可执行规范为核心,构建五层执行模型,反转传统架构关系,强调漂移检测,明确人机分工,具备五项核心能力,但采用时也面临多种权衡。
不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?
文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求大。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。
Google全链路赋能出海:3人团队调度千个智能体,可成独角兽|MEET2026
在量子位MEET2026大会上,Google Cloud大中华区负责人Dennis Yue称智能体为初创出海注入新内涵。谷歌推一体化方案全链路赋能,还谈到Gemini 3突破、A2A协议及商业模式转变等。
“别再碰我代码!”明星AI工具成瘟神,用户怒斥:一周七千块,修不好bug还删我关键文件!
AI编程服务提供商Replit推出新一代AI编程助手Agent 3,CEO称其为软件“自动驾驶时刻”。但用户反馈它修不好bug还删关键文件,成本也高,Replit回应强调“模型栖息地”和“事务性”机制重要性。
AI胡说八道这事,终于有人管了?
AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还能识别逻辑错误,团队已公开数据集。
Claude Code之父最新访谈揭秘:Claude Code 迭代靠的是直觉「附个人独家使用秘笈」
Claude Code项目负责人Boris Cherny在访谈中揭秘其迭代靠‘直觉系统’,探讨智能体编程实用化、模型演进等。他还谈及软件工程师未来工作转变,给出使用Claude Code秘笈,强调基础与创造力重要性。