「Think Tool」共找到 231 篇相关文章
拒绝小扎15亿美元offer的大佬,还是加入Meta了
曾拒绝小扎15亿美元薪酬包的机器学习大神Andrew Tulloch加入Meta。他此前在Meta工作11年,后到OpenAI,今年1月随前CTO创立公司,两个月前还拒绝Meta邀约,现入职具体工作未知。
OpenAI深夜甩出GPT-5.1,称更热情,更智能!网友狂吐槽:我不想和它聊天,只想用它工作
OpenAI发布GPT-5.1,包括Instant和Thinking两个版本,称更智能、对话更愉快,还增加“个性/语气”选项。但网友质疑“强化个性”方向,想要高效工具而非“虚拟朋友”。
ICML 2026 |让大模型边想边说:这篇文章把「何时开口」变成可学习策略
论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。
第 2 章 主流 Agent 模式深度解析
文章深度解析主流 Agent 模式,用生活化类比介绍了 ReAct、Plan - and - Execute、Tool Use、Reflection / Self - Critique 四种模式,阐述其技术要点、优缺点及适用场景,还对多模式进行对比。
谷歌AI连发6篇数学论文!Gemini攻入博士级科研,91.9%刷爆SOTA
谷歌DeepMind放出多篇重磅论文,Gemini Deep Think成「科研合伙人」,攻克多领域难题。谷歌打造基于Gemini的「AI数学家」Aletheia,在博士级难题获科研里程碑,首批6篇论文成果斐然。
知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳
东南大学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三大知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。
Claude 这个更新,让模型能力提升10%+!
Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越大。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。
硬核拆解 OpenClaw:如何构建真正稳健的生产级 Agent 系统?【下】
本文延续上篇,继续拆解 OpenClaw 中 Agent 模块工程方法,涵盖安全与风险防御、记忆与状态管理、成本与效能优化、子 Agent 协作机制,介绍其方法并解读,指出企业场景需做取舍。
Agent 成大厂新“战场”?从同程旅行 DeepTrip 看垂类 Agent 的设计与落地实践
文章聚焦同程旅行推出的垂类旅行 Agent DeepTrip,介绍其设计与落地实践。它能降低旅行决策成本,构建旅行服务生态。团队基于多方面考量选 Agent 架构,还从多维度介绍实现方法及未来规划。
LangChain Memory 太弱?试试用 MemOS 构建 Agent 专属的“记忆图谱”。
文章聚焦 MemOS 开源框架,深入体验其记忆“图谱”能力,探讨将它集成到基于 LangChain1.x 框架构建的智能体的方法。介绍了基于记忆“图谱”构建 ChatBot、体验记忆“图谱”自动重组,以及集成到 LangChain 智能体等内容。