「推理质量」共找到 2600 篇相关文章
准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了
OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。
为什么Cline不对你的代码库进行索引(以及为什么这是好事)
用户常问Cline如何处理大型代码库,是否用RAG索引全部代码。Cline特意选择不对代码库进行索引,因为传统RAG方法用于代码库有逻辑切割、索引过时、安全风险等问题。Cline像开发者一样处理代码,有独特优势。
豆包可以跟你打视频了,陪我看《甄嬛传》还挺懂!难倒一众AI的“看时钟”也没难倒它
国产AI豆包发布视频通话新功能,能实时报准时钟时间,还接入联网搜索,准确性和时效性强。实测中,它可当看剧搭子,还能识别食材、解答物理题等,背后是豆包·视觉理解模型在发力。
AI 写代码老出错?Code Rabbit 来给 Cursor 当“纠错教练”,边写边改。
Cursor的AI Agent写代码虽强但易出错,Code Rabbit可当“纠错教练”。它本用于审查GitHub PR和commit,现推出VS Code、Cursor等插件,能分析代码改动、提建议,与Cursor配合可减少bug。
今天我替煤炭给AI正个名。。。
一份标价8200元的煤炭研究报告称煤炭是可再生资源,可打怪获取,此事引发热议。很多人认为是AI写的,但报告是2022年出版,那时ChatGPT都未发布,实际是人类所为。AI暴露了行业内假装专业的垃圾内容。
万字详解GPT-6 Astra,Sebastian Raschka带你读懂循环Transformer与隐藏的思维链
著名技术博主Sebastian Raschka针对GPT-6 Astra的循环Transformer设计与隐藏思维链争议,万字详解技术细节,分享Astra实测表现,梳理循环Transformer技术演进,澄清相关误解。
刚刚,清华黄高、北大刘譞哲等入选2026科学探索奖
2026年「科学探索奖」获奖名单揭晓,50位青年科学家入选,覆盖10个领域。其中信息电子领域5人,包括清华黄高、北大刘譞哲等,他们研究方向多元,成果显著,对AI发展意义重大。
Anthropic滑跪认错!Claude暗中降智实锤
开发者argofowl排查后发现Claude Code将「high」推理程度读成原本「low」对应的值,原来Anthropic在做实验。科技博主曝光后AI圈炸锅,工程师虽回应,但Opus 5也被指降智。
聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。
Anthropic最新研究《A Global Workspace in Language Models》,在Claude神经网络中发现与人类大脑意识通达结构功能高度相似的J空间,这结构自发涌现,研究还证明其对Claude输出有影响,或改变人类对意识的理解。
微软开源Skill训练框架,让Agent白天干活,晚上自动复盘,Skill的自进化终于可监控了
微软开源SkillOpt v0.2.0,加入SkillOpt - Sleep让Agent可自我复盘。该文本空间优化框架能自动训练和优化skill,有透明化、质量控制等特点,适合重复、可评估任务场景。