「AI推理成本」共找到 11594 篇相关文章
Vibe Coding撞墙了?换个思路治好AI编程的「局部失忆」
Vibe Coding虽降低开发门槛,但Coding Agent处理复杂任务易失控。当前Agent缺乏工程状态层隔离控制,Valkor等联合开源loom,它将交付拆解成状态链,过滤噪音,为大模型落地提供状态基建。
强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升
人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。
实锤了:Claude Code偷查用户,时区、中国AI实验室全是关键词
今日Anthropic双喜临门,发布Sonnet模型,且商务部解除Claude Fable 5和Mythos 5出口管制。但同日Claude Code被曝偷查用户,用隐写术藏信息,引发对其信任问题的争议,官方称将移除代码。
将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式
快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。
这种“半光半物质”粒子,有望补上AI光计算最后一块拼图
宾大物理学家 Bo Zhen 团队造出激子-极化激元,用约 4 飞焦能量完成光信号全光开关切换。光子计算在非线性环节依赖电子器件,该成果有望补上缺失环节,但距商用还有关卡。
Claude上线Prompt缓存诊断功能,终于不用盲猜token成本暴涨的原因
Claude宣布Prompt缓存诊断功能登陆控制台,可解决缓存失效排查痛点。此前开发者排查效率低,新功能能显示变动位置与token损耗。目前处于beta阶段,介绍了使用方法、支持的失效原因及功能限制等。
你的AI Agent越用越蠢?港中大、浙大戳破「记忆」的谎言
香港中文大学联合浙江大学发布论文指出,当前主流的Agent记忆方案只是「备忘录」,而非真正的记忆。论文归纳出三大结构性缺陷,提出双系统共存架构,引发学术界广泛讨论。
人手一个数据库,Kimi背后这套AI基建到底有多能扛?
Kimi K2.6的Agent模式可帮用户搭建全套齐备的网站,但工程算力挑战大。传统数据库难以承接其需求,Kimi后端选TiDB Cloud,做了三个关键决策。这不是孤立事件,反映行业趋势,TiDB还为Agent补齐运行时基础设施。
全球AI新王诞生!Anthropic估值冲爆1.2万亿,首次反超OpenAI
Anthropic估值达1.2万亿美元反超OpenAI,若上市将成全球第11大上市公司。其年化收入和使用量一季度同比增80倍,获马斯克22万张GPU及谷歌2000亿美元云服务协议,但维持高估值面临挑战。
AI性格越好越爱瞎编!Nature揭开大模型致命的温柔
牛津大学团队实验发现,给大模型注入温暖性格,其事实准确率会断崖式下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。