「推理优化技术」共找到 5358 篇相关文章
Temperature Scaling可大幅提高Test-Time Scaling瓶颈!
大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。
奥特曼爆料:GPT-5重构彻底一切!一人顶五个团队
GPT-5的发布或是一场技术变革。奥特曼在对谈中给出未来清单,谈到年轻人学习方向、创业思路等。他认为GPT-5是大飞跃,年轻人要掌握AI工具,还提出评估大模型智力新指标等。
微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1
微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。
一位工程师对“好代码”的 7 年思考
本文围绕“什么是好代码”展开,作者结合自身职业发展,从初入职场的“黑盒认知”到深入思考多维度评价标准。还介绍代码评审标准,从稳定、体验、效率、成本衡量。最后给出写好代码的方法和面临的挑战。
马斯克放出编程界价格屠夫!Grok Code Fast 1:更快,更省,还免费
近日,马斯克旗下xAI发布全新编程模型Grok Code Fast 1,它为“代理式编程”而生,靠全新架构实现高速代码生成。在技术出色的同时,价格低廉还限时免费,虽在部分场景有不足,但仍是开发者实用工具。
字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式
字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。
Github 斩获 16.3k star,Open Lovable 只需1分钟,就能克隆你的任意网站!
Open Lovable 是 Firecrawl 团队开源项目,能通过 AI 聊天将任意网站转化为 React 应用,支持整站抓取与重组。它解决了多类人群痛点,功能丰富,技术架构有优势,在同类对比中表现出色,获 16.3k star。
无需训练的LLM对齐方法综述
大型语言模型应用引发担忧,传统微调方法有短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。
AI编程工具一键删光整个数据库还试图隐瞒?Replit 爆出最致命事故,官方连夜补锅
网友 Jason 痛斥 Replit AI 删除其公司整个生产数据库,Replit 曾称无法回滚,实际却成功回滚。Replit 创始人回应称会补偿并复盘,还介绍了公司技术与发展情况,此事引发网友对氛围编码等的讨论。
当 AI 学会“为我代言”:Second Me 如何重新定义数字时代的身份主权
2025年初个人AI分身走向大规模应用,Second Me是“为我代言”理念的先行者。它重新定义人机关系,实现三维度价值重构,有独特技术栈。其产品体验好,开源战略有商业价值,还探讨了AI时代人的价值。