「推理工程」共找到 2753 篇相关文章
马斯克说到做到:开源X平台核心推荐算法
X(原Twitter)开源内容推荐Feed on X召回、精排推理、策略代码,模型参数配置较小,应是简化Demo版。召回用双塔模型,精排用双层Transformer,还介绍了系统架构、模型细节等。
企业级 AI Agent规模化落地的避坑指南,就藏在这四大趋势里
2025 年被视为企业级 Al Agent 落地拐点,“价值导向型”采购兴起,RaaS 正压过传统 SaaS。文章介绍 MCP、GraphRAG、AgentDevOps、RaaS 四大趋势,给出工程化解法,还展示金融、招聘等场景案例及落地自检清单。
谷歌与OpenAI同获ICPC 2025金牌!GPT-5满分夺冠,Gemini攻破人类队伍都没解出的难题
ICPC是计算机程序设计领域的“奥林匹克”。今年GPT - 5满分、Gemini 2.5 Deep Think解10题,达金牌水准,超越人类强队,标志AI在算法竞赛“超车”,证明其具备临场推理等能力。
陶哲轩都惊了!o3首战「AI奥数」碾压夺冠,开源军团仅差5分狂追OpenAI
AI界奥数杯重启,OpenAI o3首参赛,算力拉满时以47分夺冠。测评显示在奥数数学推理上,商用和开源AI差距缩小,开源即将追上商用模型。报告完整测试结果已放出。
小米MiMo-V2-Flash开源:3090亿参数大模型能否改写AI行业规则!
2025年12月16日小米开源旗舰大模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。
为什么 LLM 搞不定复杂任务?ReAct 与 Reflexion 技术综述
文章指出大语言模型处理复杂任务存在事实幻觉、缺乏实时信息等问题。介绍ReAct将推理和行动结合,及Reflexion在其基础上添加评估反思机制,探讨两者结合优势,还提及未来发展方向。
刚刚,北大&360里程碑式突破!32B安全分碾压千亿巨兽
2025年9月23日,北大 - 360联合实验室发布TinyR1 - 32B模型,仅用20k数据微调就实现安全性能突破,兼顾推理与通用能力。还推出TinyR1 - Safety - 8B,且系列模型已全面开源。
维纳智能登上Nature通讯:AI不只会回答问题,开始生成高精度行业数据
维纳智能登上Nature通讯,其让大模型自动生成高精度推理数据,用闭环反馈驱动专业Agent自主演化。该公司在多领域交出工业级精度答卷,还解决了Agent泛滥的困局,推出多款创新产品。
Claude写80%代码,Anthropic工程师却越来越孤独
Anthropic工程负责人Fiona Fung带领团队用Claude Code使人均代码量翻8倍,但工程师交流减少,孤独感渐生。此外,还存在上下文切换、心流体验变淡、工作意义减弱等问题,工程师职业边界也在变模糊。
香蕉和GPT Image之外的第3条路:华人15人团队造出AI生图黑马
一支不到15人的华人团队推出AI生图模型Uni-1.1,在Arena.ai榜单冲进全球前三。它将推理和生成融入同一模型,创意可控,价格低,已获阿迪等企业认可,未来将拓展到多模态系统。