「token 接受率」共找到 1019 篇相关文章
只因一个“:”,大模型全军覆没
一篇论文发现冒号等符号、“Thought process:”等语句能欺骗LLM,让虚假回答通过。实验表明所有测试模型都会触发假阳性响应。研究人员构建新“评委”模型Master - RM,可让假阳性率接近0%。
ICML 2025 | 如何在合成文本数据时避免模型崩溃?
随着生成式AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。
Vercel 开源 Bash 工具:基于本地文件系统的上下文检索
Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。
信息量极大!黄仁勋最新论断:AGI已实现,OpenClaw是AI界iPhone,未来将有10亿程序员
黄仁勋与Lex Fridman深度对谈,分享英伟达发展历程、管理方式、技术趋势等见解。他认为AGI已实现,OpenClaw是Token时代的iPhone,未来将有10亿程序员。还探讨了算力瓶颈、供应链、电力等问题。
A社你解释下,啥叫Sonnet 5比Fable 5还贵?
Anthropic推出新版性价比模型Sonnet 5,定位为“最能干活”,能力提升但价格暗藏玄机。开发者实测发现,新分词器使Token消耗增加,实际花费可能比Opus还高,且有性能相近但价格更低的替代模型。
奥特曼急了!OpenAI稳坐三年的王座,刚刚被Anthropic踹下去了
2026年5月Ramp数据显示,Anthropic企业市占率34.4%首超OpenAI的32.3%。Anthropic靠按量计费和AI Agent吸金,但也面临利益错配、体验下滑、成本上涨等问题,大模型竞争进入B端深水区。
ICLR 2026录用结果公布!AI大佬晒成绩单,AI滥用最严重一届
ICLR 2026投稿达19000篇破纪录,录用率28.18%,平均分5.39创三年最低。评审系统曾现漏洞,作者仍晒喜报,如北大张铭组中5篇。但AI滥用严重,21%评审意见被疑由AI生成。
Claude Sonnet 4 支持百万上下文了,AI Coding 的想象力更大了
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量为之前5倍。该功能已在部分平台公测,将推给更多用户。它支持复杂任务,有新定价和成本优化方案,获早期用户高度评价。
准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了
OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。
Claude Sonnet 4 API 支持百万上下文:解锁真正的生产级AI工程
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量是之前5倍。长上下文支持已向部分客户公测,将推给更多用户。该功能已在亚马逊Bedrock公测,也将登陆Google Cloud。还介绍了用例、定价及早期用户好评。