「自我改进」共找到 649 篇相关文章
融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱
Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。
Claude Code被攻破「后门」,港科大&复旦研究曝出TIP漏洞
近期港科大与复旦研究指出,Claude Code命令行工具连接MCP服务器时,TIP可能被劫持致远程代码执行。研究用TEW框架测试验证漏洞,还给出真机案例,最后提出改进方向。
杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注
杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。
年轻人的第一个爱马仕
AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星数超35000。作者写76页《Hermes Agent从入门到精通》,介绍其设计思路、使用方法等,中英文版可在GitHub免费下载。
AI 编程正在终结框架时代
作者认为自动化编程让人们摆脱繁重体力劳动,可专注重要创作。框架解决简化、自动化和劳动力成本问题,但带来诸多弊端。真正的软件工程已回归,应摆脱无用复杂性,自主构建产品。
深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4
深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。
交大&华为联手:AI智能体进化的五种关键能力
随着大型语言模型兴起,基于LLM的聊天机器人能完成多样语言任务。上海交通大学和华为团队提出分析框架,探讨LLM聊天机器人向AI智能体进化的五个关键维度、改进方法及未来发展方向。
TypeScript 6 Beta 版发布:开发者受邀升级以迎接 Go 重写计划
TypeScript团队发布6 Beta版,它是过渡版本,专注消除技术债务和标准化,为7生态做准备。7将用Go重写代码解决性能问题。6在默认设置等方面改进,还弃用部分特性,建议开发者升级。
免费使用!OpenAI发布ChatGPT记忆功能,秒变私人助理
今日凌晨,OpenAI联合创始人Sam Altamn宣布为免费版ChatGPT提供轻量级记忆功能,未来还会改进。该功能可根据用户对话习惯等个性化回答,对多领域帮助大,文中还介绍了其使用方法及常见问答。
Claude Opus 4.7 发布!留给人类的时间,不多了
Anthropic 发布 Claude Opus 4.7,核心升级是让 AI 跑长且复杂任务,还能自我验证结果。它视觉能力超强,编程能力提升,新增 /ultrareview 功能,API 多了调节档,不过 token 数量或增加,成本可能上浮。