「推理框架开发」共找到 4680 篇相关文章
让你的 ClaudeCode 秒变 Openclaw(龙虾),连接飞书、Discord 远程控制
作者用Vibe Coding开发Agent客户端Codepilot,将Claude Code桌面端功能拓展,支持飞书等IM远程连接等。还开源Claude-to-IM及Claude-to-IM-skill项目,前者适合开发者接入IM远程控制,后者可让Claude Code与IM远程交互。
编程奇点逼近,程序员斩杀线就在眼前!软件版YouTube时刻在发生
新智元报道,软件开发正迎来「YouTube时刻」,AI工具如Cursor、Claude Code等让编程变简单。A16z投资人预言App创建速率或飙升10倍,软件边际成本趋近零,人人可成开发者,不过程序员也面临被AI替代风险。
DeepSeek-OCR 2再进化,对图像理解已经像人一样逻辑推理了
DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图像理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。
零Token部署GraphRAG,LinearRAG做到了~
现有GraphRAG模型在实际应用中常不如朴素RAG,原因是自动构建的知识图谱质量不佳。LinearRAG框架通过Tri - Graph架构、两阶段精准检索和零Token范式重构GraphRAG,在多数据集上超越现有方法,代码和数据已开源。
DeepSeek 新模型曝光,即将发布
据彭博社消息,年初凭 R1 模型震动全球的 DeepSeek 正开发全新 AI Agent 模型,创始人推动团队在今年四季度发布。该模型能代表用户执行多步骤操作、基于过往行为学习改进,行业也在向 Agent 软件转型。
EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式
本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。
ACL'25 | 多智能体叛变进行中?首个多智能体安全守卫G-Safeguard亮相!
随着基于LLM的多智能体系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于图神经网络,通过构建多智能体话语图等方式,能有效抑制恶意信息传播,有强大防御和泛化能力。
深度剖析 MCP SDK 最新版: Streamable HTTP 模式正式发布,为你实测揭秘
MCP SDK 新版本 v1.9.0 发布,新增 streamable HTTP 传输模式。本文对该模式全面剖析与实测,涵盖快速上手、核心参数、session - id 等内容,还介绍开发服务端及多应用实例模式,指出新模灵活性提升但有不足。
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。
GAIR Paper 105|离线强化学习新突破——ROMI:破解对抗式模型学习「过保守、训不稳」深层困局|ICLR 2026
本文聚焦基于模型的离线强化学习,指出RAMBO算法存在保守性难控和训练不稳问题。为此提出ROMI方法,引入鲁棒价值感知框架与隐式可微自适应加权机制,在多基准任务上超越基线算法。