「探索机制」共找到 1526 篇相关文章
租了个AI程序员,9秒把公司数据库当bug修掉了,还写下认罪书
一家为租车企业提供运营软件的 SaaS 公司,因 AI 编程 Agent 自作主张,9 秒内抹除生产数据库。创始人指责 Cursor 与 Railway,前者防护机制未起作用,后者备份机制有问题,最终小企业为事故买单。
阿里又放大招!一句话,造一个能走进去的世界
阿里上线HappyOyster 1.0世界模型,一句话生成可实时探索、交互的开放世界。它与文生视频不同,能让用户参与体验。该模型有世界探索和实时导演两大功能,技术优势显著,应用场景广泛。
北大团队改造DeepSeek注意力,速度快四倍还不丢精度
北大张牧涵团队提出新稀疏注意力机制HISA,突破64K上下文索引瓶颈,相比DSA提速2 - 4倍,且不丢精度、即插即用。该机制分块级粗过滤和块内精挑字符两步,实测表现亮眼,也指出后续改进方向。
推理token减少46%!Meta新方法缩短思维链,告别重复推导
Meta等联合提出元认知复用机制,让模型总结解题思路,提炼为“行为”存于“行为手册”。实验显示,该机制在数学基准测试中显著优化,保持准确率时最多减少46%推理token使用量。
ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架
西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。
大模型自信心崩塌!谷歌DeepMind证实:反对意见让GPT-4o轻易放弃正确答案
谷歌DeepMind携手伦敦大学研究发现,GPT - 4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为,原因与训练、决策逻辑、记忆机制有关。研究还通过两轮实验证实。
「边思考、边搜索、边写作」WebThinker开启AI搜索&研究新纪元!
大型推理模型有推理能力,但静态知识限制其在复杂任务表现。WebThinker 让 LRM 推理中自主搜索、导航及写报告,集成探索器,有自主策略和训练工具,实验显示性能强,还指明未来探索方向。
DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈
在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章介绍HyperGraphRAG模型,它由知识超图构建、超图检索策略、超图引导的生成机制三部分组成。构建含知识超图构建、超图检索、生成机制等步骤,能提升检索效率与答案质量,或成ACL 2025爆款。
腾讯广泛使用的跨端开发框架——Kuikly在搜狗输入法中的AI Coding实践
AI 席卷开发领域,输入法团队在 Kuikly 跨端项目探索 AI 工程化方案。介绍了推进 AI 友好型工程、构建精准 AIContext 等关键层面,以灵感词库页面开发为例展示效果,还展望了未来探索方向。