「工程概念」共找到 1024 篇相关文章
Anthropic 发布最新研究:LLM 展现初步自省迹象
Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。
企业级 AI Agent规模化落地的避坑指南,就藏在这四大趋势里
2025 年被视为企业级 Al Agent 落地拐点,“价值导向型”采购兴起,RaaS 正压过传统 SaaS。文章介绍 MCP、GraphRAG、AgentDevOps、RaaS 四大趋势,给出工程化解法,还展示金融、招聘等场景案例及落地自检清单。
思维锚点:破解LLM Reasoning黑箱的关键句
文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。
LLM 竟然会内省!Anthropic 整了个大活:首次揭开 AI 意识
Anthropic最新研究《大语言模型中涌现的内省意识》,首次通过直接操控模型内部状态验证AI能否觉察自己思想。研究采用概念注入技术,发现AI有内省能力,且不同模型表现有差异。
比Gemini 3记得更多,谷歌新框架将上下文记忆干到了200万!
Google在NeurlPS2025大会推出结合RNN与Transformer的全新架构Titans,能扩展到超200万个token上下文。背后涉及Titans和MIRAS两篇论文,共同推进测试时记忆概念,实验显示新架构性能出色。
Agent之间,有互联网了!
明略科技开源发布Octo,旨在构建开源可信的Agent协作网络,让人、Agent和外部工具进入同一协作系统。它有三个核心概念、六种协作模式、四个端,推动AI应用从个人工具向组织协作网络迁移。
Claude写80%代码,Anthropic工程师却越来越孤独
Anthropic工程负责人Fiona Fung带领团队用Claude Code使人均代码量翻8倍,但工程师交流减少,孤独感渐生。此外,还存在上下文切换、心流体验变淡、工作意义减弱等问题,工程师职业边界也在变模糊。
姚顺宇谷歌首秀,Gemini新模型刷爆SOTA:人类仅剩7人捍卫碳基编程
面对Claude Opus 4.6和GPT Codex 5.3的攻势,谷歌升级Gemini 3 Deep Think,在多项基准测试刷爆SOTA,推理成本降低82%。它还走进科研工程领域,其研发团队有不少华人,如姚顺宇、Yi Tay。
AI 太烧钱!微软选择「倒戈」DeepSeek
微软宣布Copilot Cowork全球上线并引入按使用量计费机制,还评估引入DeepSeek V4。Agent普及使AI成本问题凸显,微软进行系统性重构,构建质量保障体系,成本工程化能力成竞争新焦点。
【访谈对话】造过 Codex 的人,为什么每天用 Claude Code
Calvin French - Owen 曾参与构建 Codex,如今日常用 Claude Code。他与 Garry Tan 在 YC 播客对话,探讨了编程 Agent 产品哲学差异、分发逻辑、上下文工程等,还提及 Segment 重建、未来设想及安全等问题。