「系统2」共找到 3427 篇相关文章
Self-Evolving 会是 2026 关键词吗?
2025年,Agent应用发展使LLM‘静态’局限成AI瓶颈,业界重视自进化能力,聚焦‘持续适应系统’。但该领域缺统一标准,有思潮认为统一标准、集体探索将带来机遇。还介绍了研究进展、重点演变等。
刚刚,美团开源全模态龙猫模型,和 ChatGPT 大战 100 回合打得难解难分
美团发布开源全模态 MoE 模型 LongCat-Flash-Omni,参数 560B 激活 27B。它有真正全模态能力,采用创新架构和训练范式,基准测试表现亮眼,部分指标超 Gemini-2.5-Flash,引发网友热议。
智驾新玩家首秀,“含模量”将成为新标准|甲子光年
9月28日千里科技召开首次品牌发布会,董事长印奇展示智能辅助驾驶系统能力。其角色从定点车企服务商变为全车企伙伴,首创‘含模量’概念,还公布‘千里计划’,欲构建跨场景智能服务体系。
全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品
蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。
AI修Bug新SOTA:SWE-Bench Lite60.33%修复率,像人一样能积累经验,中科院软件所出品
ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复率达60.3%居首。
ChatGPT还没学会打电话,谷歌搜索AI已经替你电话约服务,还会谈价砍单!
谷歌搜索迎来三大AI革新,集成Gemini 2.5 Pro模型、可用Deep Search功能,最亮眼的是AI代打电话功能。目前该功能在美国上线,未来将全球推广,引发网友对其效果和实用性的讨论。
这个项目专治建模手残党,给张图就能转变可编辑能转动的3D模型
img2threejs上线11天获4.8k Star,专治建模手残党。给它一张图,它让AI写代码把物体“搭”出来,不重建几何,也不下素材包,还省Token、零依赖,有严格质量门控。
AI最大的礼物,是让你能廉价地失败100次
文章指出AI最大的礼物不是让人成功,而是让人能廉价地失败。AI让开发成本降低、心力节省,增加了尝试机会。但人们需发布产品获取反馈,构建可演化系统,让失败为后续铺路。
AI读不懂文档结构?计算所重构Agentic RAG文档推理能力
大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在多数据集验证效果显著。
更新啦!我用 Claude Skills 做的剪辑 Agent!识别效果+交互大升级
作者成峰根据用户反馈对剪辑 Skills 做了大改,替换火山引擎音视频识别模型、提升交互界面。改进包括用 API 替代本地模型、重构口误识别系统、设可视化审核界面,还介绍了简单使用方法。