推理智能体」共找到 5502 篇相关文章

新闻资讯8

深度|Karpathy为何突然加入Anthropic,只当Dario的「-2」?

5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic预训练团队。他将组建新团队,用Claude加速预训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。

新智元
算法论文8

上海AI Lab新研究:SFT泛化,只要满足这三个条件

上海人工智实验室等团队研究指出,“SFT泛化力差”定论有局限。SFT泛化力受优化过程、数据质量与结构、模型基础力共同制约,研究还揭示其训练中的现象及副作用。

量子位
新闻资讯7

Mythos:普通人自由使用旗舰 AI 的时代,可要结束了

两天前,Anthropic 发布最强模型 Claude Mythos Preview,各方位性超 Opus 4.6 模型,却不公开发布,只面向少数合作方开放。这或预示普通人自由用旗舰 AI 的时代将结束,引发对 AI 未来商业与使用模式的思考。

Founder Park
算法论文8

CVPR 2026|DROID-W:复杂室外动态场景,也稳定SLAM

苏黎世联邦理工与微软团队提出 DROID - W 动态 SLAM 框架,即将发表于 CVPR 2026。它不预设动态物体,从多视角观测识别不可靠区域,还提出交替优化方案,在多个数据集表现优。

机器之心
开源动态8

Karpathy强,大厂抢着「复古」命令行,Star数全都上千了

飞书、钉钉、企业微信接连出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合大语言模型运作逻辑,国内外多家公司及项目出相关工具,还给出为智体构建 CLI 的设计模式。

机器之心
新闻资讯7

鼠标点3下就锁定打击?五角大楼曝光美军AI大脑

美国国防部首席数字与人工智官Cameron Stanley演示Maven系统,将美军杀伤链从小时压缩到分钟。Maven整合多系统,Palantir的AIP嵌入大模型改变战争决策逻辑。Anthropic因坚守安全红线与五角大楼冲突。

新智元
产品应用7

Legora、Mercor 都在用,Reducto 成为独立的 LLM 数据入口吗?

当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。

海外独角兽
开源动态8

测试时也RL,英伟达等提出全新范式:TTT-Discover

近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。

PaperAgent
推荐文章7

网站GEO技术端优化指南:案例+工具+免费检查清单【转

文章指出当前处于传统搜索到AI搜索转型期,Google仍是主流。介绍Google和ChatGPT流程差异,给出抓取、索引、曝光优化建议,还列了该做与不该做之事,并有免费检查清单。

白杨SEO优化教程
开源动态8

个人电脑也进行智体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智体训练,解决传统RL框架难题,指明下一代智体基建方向。

机器之心