「思考Agent模型」共找到 9679 篇相关文章
自动化浏览器
Skyvern是能自动化浏览器操作的工具,底层靠大语言模型和计算机视觉。它提供简单API接口,可在大量网站自动化手动操作,替代易出错的自动化方案。介绍了其原理、使用方法、功能等。
OpenAI谷歌Anthropic罕见联手发研究!Ilya/Hinton/Bengio带头支持,共推CoT监测方案
OpenAI、谷歌DeepMind、Anthropic联合发表立场文件,提出CoT监测概念,认为是控制AI Agent核心方法。探讨其潜在机遇、局限,还提及不同公司对CoT监测的不同态度,如OpenAI乐观,Anthropic焦虑。
终于找到一个开源神器!用画布喂给 Claude Code,上下文再也不用打字说了!
开发者用文字向 AI 说明需求繁琐,思路易跑偏。BonsAI 是 macOS 原生应用,提供无限画布,可让 Agent 实时读取改写。它亮点多,还有连接器功能,能成编程工具‘前置处理器’。
一个任务50次调用,成本狂砍90%?Manus首次公开上下文工程秘诀,一堆反复重写换来的教训
Manus项目团队分享上下文工程秘诀。他们押注于此,使产品发布改进更快。还阐述围绕KV缓存设计、掩码非移除工具、用文件系统作上下文等原则,助构建AI Agent者少走弯路。
北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think
北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。
Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?
LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。
太强了!这个 NotebookLM Skill,真的把 NotebookLM 搬进了命令行!
Google的NotebookLM凭借强大模型能力成AI圈“现象级”产品,如今开发者将其搬到命令行,开源神器notebooklm - py诞生,具备AI Agent工具、研究自动化等功能,有多种使用方式。
刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5
刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5,Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5。API平台已更新,价格和之前Pro预览版基本一致,但网友实测发现CoT表现不佳。
腾讯AI Lab 提出解耦推理新框架,破解IMO 数学难题
腾讯AI Lab梁振文和宋林峰提出“解耦推理与证明”框架,解决当前大语言模型在自动化定理证明领域“思考”与“证明”能力失衡问题,成功解决5道IMO难题并开源成果。
Spec 退场,skills 上位:Codex 团队的产品方法论变了
文章介绍了OpenAI Codex团队产品方法论的变化,从重视spec转向skills,开发从“描述过程”转向“组织能力”。还谈及Codex app开发、团队协作等,指出模型变强后工作模式转变,职业边界模糊,团队招人看重主动性。