LLM框架」共找到 2432 篇相关文章

算法论文8

给你一群顶尖AI,如何组队才能发挥最大战力?UIUC用一个新的多智能体协作基准寻找答案

现有的评测基准无法衡量多智能体系统内部的协作效率、沟通质量和竞争策略。为此,伊利诺伊大学厄巴纳 - 香槟分校的研究者推出 MultiAgentBench,能全面评估 LLM 多智能体系统协作与竞争能力。

机器之心
算法论文8

复旦提出自适应Reasoning方法ARM,“能屈能伸”

复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。

深度学习自然语言处理
推荐文章7

InfoQ 2025 年趋势报告:软件架构和设计

InfoQ 2025 年软件架构和设计趋势报告,借助《跨越鸿沟》模型分类。涉及 AI 多方面趋势,如 LLM 普及但应用场景存疑,还有 Agentic AI、SLM 等创新领域,以及 RAG、AI 辅助开发等不同阶段趋势。

InfoQ
推荐文章7

《动手写AI Agent》流式输出:别让用户干等着

文章围绕《动手写AI Agent》流式输出展开,指出此前Ling使用体验差,因无流式输出,用户等待久。介绍主流LLM流式接口基于SSE,对比OpenAI、火山引擎与Claude格式差异,并定义统一的StreamChunk类型。

AI Reading Hub
新闻资讯7

OpenAI公开新的模型训练方法:或许能解决模型撒谎问题,已在GPT-5 thiking验证

OpenAI公开名为“坦白”的模型训练方法,可解决LLM欺骗行为。该方法强制模型自我反省,“坦白”奖励与“主要回答”奖励分离。在GPT - 5 - Thinking上实验,能提升不良行为可见性,但对“无知的错误”有局限。

AI寒武纪
算法论文8

震撼!AI物理「双修」:亥姆霍兹方程嵌进生成器,伪影当场消失

抢滩6G前夜,香港科技大学(广州)等机构发布PhyRMDM框架,将物理约束与生成模型能力融合,解决传统AI构建无线电地图预测失真问题,成果被顶会ACM MM 2025接收,代码和权重已开源。

新智元
开源动态8

python打造Google(A2A)+MCP,Langchain生态互补

文章介绍Google的Agent2Agent(A2A)协议,它能实现AI代理通信协作,打破平台孤岛。还提及MCP协议,二者互补。重点介绍python - A2A库,它实现A2A规范,与多框架、模型集成,给出实战示例。

CourseAI
算法论文8

无需人工标注!AI自生成训练数据,靠「演绎-归纳-溯因」解锁推理能力

新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。

新智元
开源动态8

字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手

传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。

深度学习自然语言处理
新闻资讯8

留给人类数学家的悬赏不多了!谷歌DeepMind一口气解决9道埃尔德什问题

AI进军数学界速度惊人,谷歌DeepMind发布由Gemini驱动的AlphaProof Nexus框架,解决9个埃尔德什开放问题,还证明44个猜想、搞定代数几何难题、改进凸优化理论边界,推理成本低且代码开源。

量子位