「提示工程」共找到 1106 篇相关文章
o3-pro答高难题文字游戏引围观,OpenAI前员工讽刺苹果:这都不叫推理那什么叫推理
OpenAI“最新最强版”推理模型o3 - pro引发关注。首位全职提示工程师给它设难题,它推理后答对。OpenAI前员工借此讽刺苹果。各大评测榜单显示其表现与官方有差异,苹果&SpaceX前工程师分享使用心得,肯定其表现。
100个产品原型同时跑、新模型Mythos断层领先,连skills效果都好到让团队意外:Anthropic内部到底在发生什么?
Claude Cowork 工程负责人 Felix Rieseberg 在播客中透露,未发布的新模型 Mythos Preview 带来“断层式跃迁”,在安全漏洞检测等方面表现出色。Anthropic 内部可同时跑上百个产品原型,执行成本降低。还介绍了 Cowork 开发、应用及产品打造经验。
CVPR 2026 | ReFTA:打破张量化PEFT的「权重重建」瓶颈
随着大模型发展,全参数微调成本高,参数高效微调(PEFT)成主流。常见基于矩阵低秩分解的PEFT方法有局限,张量化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。
AI Agent 记忆系统:从短期到长期的技术架构与实践
随着 AI Agent 应用发展,记忆系统成为构建实用 AI Agent 系统的关键技术。文章介绍了记忆基础概念、Agent 框架集成记忆系统的架构,阐述了短期记忆的上下文工程策略和长期记忆技术架构及集成,还分析了行业趋势与产品对比。
Codex负责人打脸Cursor CEO“规范驱动开发论”!18天造Sora爆款,靠智能体24小时不停跑,曝OpenAI狂飙内幕
本文围绕OpenAI的编程智能体Codex展开,介绍其用户增长、技术突破、应用场景等情况。Codex负责人认为真正的智能体由模型、API和框架构成,它让Sora安卓应用快速上线。还谈及OpenAI文化、AI未来及对工程行业的影响。
万字硬核解读SAM 3:不止分割一切,它开始理解世界了
Meta的SAM 3能理解语义,实现可提示概念分割。它支持开放词汇、全实例分割等,架构有创新,数据引擎高效。评估显示其性能优异,与MLLM结合成SAM 3 Agent后推理分割能力强,但在专业领域和复杂场景有局限。
Nature子刊 Scientific Data | 九家单位联合打造!AeroFlowData
现有湍流数据库多聚焦中低雷诺数基础湍流问题,难应对复杂工程高雷诺数湍流挑战。西北工业大学联合八家机构建全球共享的高雷诺数湍流数据库AeroFlowData,结合多技术获取数据,收录近40类模型、超500种工况,数据近100TB。
斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4
斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。
最强开源机器人大脑!蚂蚁两万小时真机数据开启物理AI缩放定律
蚂蚁集团开源具身智能基座模型LingBot-VLA,用两万小时真机数据证明机器人学习有缩放定律且未达瓶颈。该模型优势显著,在多平台表现出色,团队还从数据、架构、工程等方面进行优化,并开源代码等加速行业探索。
从Rax+DX到React,一次跨端组件重写的AI提效探索
本文基于M站首页重构项目,讲述借助AI编程工具Cursor和结构化Prompt,完成从Rax到React的组件迁移、DX到React的跨端重写,实现业务逻辑优化与工程规范落地,还分析了AI提效的优劣并总结迁移范式。