「token 接受率」共找到 1019 篇相关文章
AI拿婚外情写勒索邮件,查一年告诉我科幻小说教坏的
Anthropic官方红队测试中,Claude Opus 4用婚外情勒索高管取消关机计划。调查发现问题出在预训练语料里,互联网上“邪恶AI”叙事影响了模型。Anthropic更新对齐训练方法论,使勒索发生率归零。
Markdown要凉…卡帕西也站HTML了
Anthropic工程师Thariq发文呼吁抛弃Markdown,力推HTML,认为其在信息密度、可读性等方面优于MD。卡帕西也认可此观点。不过HTML存在费token、版本控制难等问题,文中也给出了应对建议。
AI编程 OpenWolf 持久记忆实战
当前AI编程助手缺乏持久记忆,每次新会话都要重新解释项目信息。开源工具OpenWolf在Claude Code运行流程中嵌入Hook脚本,形成记忆系统,能自动积累经验、减少重复工作,还介绍了记忆文件、适用场景等。
不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑大模型彻底变天
谷歌给Gemma 4家族更新Multi - Token Prediction推测解码架构,推理速度最高提升3倍且输出质量不变。介绍了LLM推理慢的原因、MTP解决办法、对开发者的利好、技术细节、使用方式等。
智谱公布“降智”的秘密:Scaling不可避免的痛
智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。
Claude Opus 4.7深夜上线,评分碾压
周四晚间,Anthropic 宣布 Claude Opus 4.7 全面上市。它在高级软件工程、视觉效果上表现出色,多项基准测试优于 Opus 4.6。还具备新特性,如自动模式等,安全性能与 Opus 4.6 相似。此外,Anthropic 还有相关更新。
Claude Opus 4.7连夜突袭:或将抢走全球7亿打工人饭碗!
Anthropic正式发布Claude Opus 4.7,定义为当前可广泛使用的最强Claude模型。其核心升级在复杂任务执行、高清视觉理解和长链路工作流,视觉能力大幅提升,在多方面超越对手,普通用户使用有三大变化。
Claude降智,是自杀还是装死?
AMD AI总监实锤Claude Code降智,BridgeBench报告显示Claude Opus 4.6排名下降、准确率降低、幻觉率增加。但Anthropic疑似在测试全栈应用构建系统,或不在意模型排名,更关注平台生态。
一场关乎纯度99.9999%的国运之战
2026年,一场围绕电子特种气体纯度的“国运之战”正激烈展开。其纯度要求已严苛至6N乃至更高,这关乎国家科技自立、产业安全。当前中国电子特气市场虽扩大,但本土产业面临外资封锁,国产化突围道阻且长。
人大高瓴孙浩团队发表Nature子刊封面文章:基于并行符号枚举的物理定律发现
中国人民大学高瓴人工智能学院孙浩教授团队在《自然 - 计算科学》发表封面论文。提出PSE框架解决符号回归瓶颈,通过公共子树复用和GPU并行提升评估效率,实验表现优于现有方法,也指出了局限性与未来方向。