「推理时扩展」共找到 2923 篇相关文章
让LLM互相“审稿”:简单的LLM Collaboration/Ensemble方法实现7%性能提升
文章提出LLM-PeerReview方法,受学术同行评审启发,含评分、推理、选择模块。采用‘翻转三元评分技术’减少偏差,实验显示该方法超单一LLM及LLM Ensemble基线,性能提升显著。
美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局
近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。
Clawdbot为何大火?
LLM记忆问题是业界难题,Clawdbot采用极简方式破解,用写Markdown实现记忆。其记忆系统优势明显,如极简易用、透明可控等,但也有劣势,像数据扩容能力有限、功能扩展性不足等。
刚刚,Claude实现「永久记忆」!官方还没上线,大神已玩疯
昨天Claude被曝要有永久记忆,今天开发者就用Smart Forking扩展让其拥有「可继承的长期记忆」。实测成功率100%,与官方知识库理念不同,Claude Code也破圈引发轰动。
《时代》2025重塑世界的五大AI进展
本文讲述2025年AI重大进展。中国Deepseek R1开源模型冲击全球格局,AI具备思考能力,特朗普政府推“星际之门计划”,AI公司支出逼近1万亿美元,同时AI与人类关系更复杂,引发风险思考。
Gemini 3 Flash 发布,多、快、好、省,Coding 能力不输大哥Gemini 3 Pro
Google DeepMind 发布 Gemini 3 Flash,成本极低。它在多项测试表现出色,速度快、效率高,代码能力超 Gemini 3 Pro,获企业客户好评,今日起向全球开发者和普通用户推送。
何恺明组三位本科生领衔!持续聚焦Flow模型,突破归一化流生成效率瓶颈
何恺明团队新作聚焦Flow模型,提出双向归一化流(BiFlow)框架,解耦前向与逆向过程,打破传统归一化流生成模型效率低下问题。三位一作是本科生,实验显示其速度和质量表现出色。
深度拆解 Claude 的 Agent 架构:MCP + PTC、Skills 与 Subagents 的三维协同
Anthropic 在 Agent 工程领域不断创新,除了 MCP 外还推出 Skills 与 PTC 并在 Claude 平台落地。本文深度拆解 MCP + PTC、Skills 与 Subagents 的定位、联系与应用,助你拓展构建 Agent 系统的思维。
这下Altman急了,OpenAI紧急启动「红色警报」
ChatGPT三周年后,Altman宣布OpenAI进入红色警报状态,调集资源改进ChatGPT。此前谷歌曾因ChatGPT威胁发布红色警报,如今谷歌等对手快速追赶,OpenAI多产品后续乏力,还面临增长与融资压力。
AI 代码审查再进化:AutoDev 多智能体协作架构深度解析
现代软件开发中,代码审查存在信息割裂、人工效率低等痛点。AutoDev 借助多智能体协作与信息聚合,实现从分析到修复的闭环智能流程,还构建多 Agent 协作体系,未来将集成更多能力。