「免费token」共找到 1041 篇相关文章
竞赛编程Agent进入全球前十!南大、清华新模型CF rating超3500
大语言模型在竞赛编程场景易失败。南大、清华等研究者提出Solvita框架,由四个角色形成闭环,构建可训练图结构知识网络积累经验。实验显示其在多评测中表现强,提升不靠增加token。
跨会话不再「失忆」:openJiuwen社区开源 AutoGenetic Memory,让Agent记忆自主生长
华为openJiuwen社区开源AutoGenetic Memory,让Agent记忆自主生长。它有分层记忆体系、Auto Dreaming等设计,能提升记忆准确率,降低Token消耗,让记忆从被动存储变为可治理、共享和自我演化的核心资产。
蚂蚁EGSS算法破解Test Time Scaling困局 | ACL 2026
蚂蚁集团CodeFuse团队在ACL 2026主会论文中提出EGSS算法,破解Test Time Scaling困局。该算法精准识别高不确定性决策点,解决计算冗余与选择脆弱问题,在SWE - Bench - Verified上全模型提升5 - 10%。
把 RAG 做成主流的公司,现在开始“做空”RAG 了
向量数据库开创者 Pinecone 宣布 RAG 时代结束,推出面向 Agent 的知识引擎 Nexus。它认为当前 RAG 模式脆弱、缓慢且昂贵,提出“知识编译”概念,称能提升任务完成率、降低 token 开销,虽面临质疑,但方向明显。
两小时激辩:黄仁勋为什么不怕 TPU、不怕华为、不怕出口管制?
黄仁勋接受长达两小时专访,谈及Nvidia使命、经营哲学等多方面。他认为能源政策制约未来,CUDA优势在于生态等,还谈了对TPU、出口管制等看法,不过其观点存在矛盾待检验。
阿里云飞天企业版X平头哥“真武”芯片,推理性能跃迁13倍,底层逻辑是什么?| Q推荐
过去几年,模型虽强但使用成本高,阻碍企业级AI深度应用。今年‘模型推理’成AI关键词,4月13日19:00,InfoQ联合阿里云邀专家围绕推理加速底层破局展开对话,探讨算力博弈、芯片性能跃迁等问题。
年轻人的第一个爱马仕
AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星数超35000。作者写76页《Hermes Agent从入门到精通》,介绍其设计思路、使用方法等,中英文版可在GitHub免费下载。
Claude Code一周份额,一天就烧完一半?有人逆向工程发现了7个bug
Claude Code在快速更新中问题频发,如思考深度大幅下降,还存在7个叠加的bug,浪费用户token配额。开发者给出应对建议,新版本增加账单透明度和缓存过期提醒,该工具正面临信任危机。
GPT-5.2破解数论猜想获陶哲轩认证!OpenAI副总裁曝大动作:正改模型核心设计,吊打90%研究生但难出颠覆性发现
OpenAI 发布由 GPT - 5.2 加持的科研平台 Prism 并免费开放。OpenAI 副总裁 Kevin Weil 回应入局科研领域问题,称模型能力超 90% 研究生,但难有颠覆性发现,还透露将优化模型设计。
The Batch: 899 | 更划算的推理
研究人员提出 Delethink 强化学习方法,训练大模型定期截断推理 token 至固定最大数量,以限制处理长思维链成本。经测试该模型在多方面超基线,且缓解计算成本限制,为长上下文推理提供路径。