「存在论」共找到 8256 篇相关文章
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。
我们测试了百度的「AI 科学家」,它正在悄悄淘汰算法工程师
百度 2025 世界大会亮相的「伐谋」,是全球领先可商用自我演化超级智能体。它源于进化论,能让算法自我进化。实测显示其在生活场景和复杂决策问题上表现优越,架构精巧,将推动算法研发普惠化。
700万参数击败DeepSeek R1等,三星一人独作爆火,用递归颠覆大模型推理
今年6月Sapient Intelligence提出的HRM影响大模型推理结构,四个月后三星研究员Alexia Jolicoeur - Martineau推出TRM,700万参数模型在推理基准测试中超越参数多10000倍的模型,还介绍了TRM原理、改进及实验结果。
苹果的局面,很迷惑
作者对比 Google I/O 大会上谷歌的表现,认为苹果在 WWDC 上的表现令人失望。苹果更新设计语言,其 AI 侧重端侧模型,有数据安全等优势,虽目前参数量小,但端侧 AI 或成新战场。
Claude Code一周份额,一天就烧完一半?有人逆向工程发现了7个bug
Claude Code在快速更新中问题频发,如思考深度大幅下降,还存在7个叠加的bug,浪费用户token配额。开发者给出应对建议,新版本增加账单透明度和缓存过期提醒,该工具正面临信任危机。
警惕!“养龙虾”风险,一键给你的Openclaw做安全体检
OpenClaw在短时间内登顶GitHub开源榜首,国内企业纷纷部署。但它存在安全隐患,如漏洞、隐私风险等。朱雀实验室联合腾讯云EdgeOne推出「OpenClaw安全体检」功能,可自动完成全面体检与风险评估。
无预训练模型拿下ARC-AGI榜三!Mamba作者用压缩原理挑战Scaling Law
CompressARC研究中,Mamba作者Albert Gu团队给出不同于大规模预训练的智能配方——最小描述长度(MDL)。一个76K参数、无预训练模型,在ARC - AGI - 1基准解决20%问题,获ARC Prize 2025第三名。
微软GigaTIME登上《Cell》:5美元切片变成免疫图谱
微软GigaTIME登上《Cell》,能把5美元H&E切片翻译成稀缺免疫图谱,在人群尺度重建TIME。它突破癌症免疫研究旧限制,成果经多数据集验证,已在Foundry Labs与HuggingFace全量开源。
ChatGPT后遗症来了!人类日常聊天越来越AI化
佛罗里达州立大学团队花两年分析ChatGPT发布前后非脚本化口语录音,在2210万个词的数据集中发现学术写作词高频出现在日常说话中,人类聊天用词渐向AI靠拢,但研究也存在局限性。
Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距
Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。