「小模型推理能力」共找到 9427 篇相关文章
吴恩达来信:AI 速度带来的价值被低估了
吴恩达指出,AI 不仅能降低任务执行成本,还能显著加快执行速度,其在创造商业价值方面的重要性常被低估。以编写代码、借贷审批等为例,说明提速能带来新价值,企业应关注可提速环节带动增长。
别再只卷Prompt 了,真正拉开Agent差距的是Context Engineering
本文梳理AI Agent从Prompt工程、ReAct范式到上下文工程的演进路径,系统讲解上下文工程核心原理、设计方法与落地方案,解决生产级Agent长任务质量退化痛点。
当AI幻觉开始操作电脑:深大、港科大提出ECA,让Agent行动前先验证证据
本文针对Agent场景下AI幻觉会转化为实际错误操作的问题,介绍深圳大学与香港科技大学提出的ECA框架,通过独立验证加门控检查降低不安全执行风险,给出测试数据验证方案有效性。
Lex Fridman 对话 DHH:Omarchy,才是真正属于 Agent 时代的操作系统
Omarchy 有望成今年最火 Linux 桌面系统、首个 Agent 时代操作系统。开发者 DHH 曾怀疑 Agent 编程,现 Quattro 代码全由 Agent 编写。DHH 做客播客,谈 Omarchy、AI 时代操作系统变化等。
任何错误只犯一次:TencentDB Agent Memory 的团队记忆实践
文章聚焦 TencentDB Agent Memory 的团队记忆实践,从组织协作现状出发,阐述其原理、结构、构建方法,通过多方面测试验证其价值,提炼出设计原则,指出其核心是治理系统,目标是提升协作带宽。
微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测
此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据集、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据集达SOTA,还给出实战代码案例。
机器人为什么要拟人?终于有人正确回答了
今年6月,英伟达发布Isaac GR00T人形机器人参考平台,深度机智发布论文Human - as - Humanoid。具身智能瓶颈是数据,深度机智以人类学习范式破局,完成全栈技术闭环,领先优势扩大。
谁说3DGS必须靠LiDAR?如视Argus入选ECCV,让图像也能提供LiDAR级位姿约束
消费级3DGS应用走向普通用户,但需精确位姿约束,过去靠LiDAR,成本高。如视Argus入选ECCV 2026,能从图像预测位姿等,为3DGS提供精准约束,推动其走向低成本采集时代。
Anthropic发布Claude Science,AI开始像研二学生一样做科研
当地时间6月30日,Anthropic发布科研产品Claude Science。它运行Claude Opus 4.8,亮点在使用方式,将科研所需整合,还能拆分任务。早期用户反馈良好,与OpenAI、谷歌竞争,已开放测试版。
离谱!我以为它只是提示词合集,结果 16.4 万 Star prompts.chat 直接把 Prompt 收藏夹干成团队资产库
一开始以为 prompts.chat 只是提示词合集,实际它把零散 Prompt 变成可搜索、可自托管、可接工具链的团队资产库。截至 2026-06-29,它在 GitHub 有 16.4 万 Star,还介绍了其功能、适用场景和局限。