「推理工程」共找到 2753 篇相关文章
毫无征兆!DeepSeek R1爆更86页论文,这才是真正的Open
两天前,DeepSeek悄无声息把R1论文从22页更新到86页,将其升级为开源社区可复现的技术报告。新论文干货多,如精确数据配方、基础设施说明等,且多项实力媲美甚至赶超OpenAI等闭源模型。
突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!
近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。
国产物理AI黑马杀出!超越GPT与斯坦福Biomni,狂揽生物制造SOTA
恩和科技发布全球首个面向生物制造的物理人工智能平台 SAION AI,打破大模型只能虚拟辅助的刻板印象。它有认知、控制与闭环执行三层架构,在多项测试中表现领先,具备多方面核心优势,推动生物制造进入智能工程时代。
AI 基础知识从-1到0.1:带你走进机器学习的世界
文章沿着AI发展脉络,从Seq2Seq到GPT模型,深入介绍关键技术原理。以简明方式梳理AI基础概念,涵盖人工智能、机器学习等定义,还介绍了各类学习方法、特征工程及向量化等内容,最后提及模型应用流程和Quick BI助力企业分析。
多模态思维链如何重塑 AI 与短视频的未来
传统多模态模型在动态视频理解与复杂推理场景面临挑战,快手开源的 Keye-VL 模型在多模态思维链技术实现突破。文章解析其核心技术,分享在快手短视频社区的落地应用,还探讨了未来“Think with Video”的技术方向。
为什么我用了那么多提示词模板甚至用了 AI 帮忙还是写不好提示词?
现在很多人觉得模型强大,提示词工程没必要,但复杂需求仍需它。作者以写雷军演讲提示词和YouTube字幕生成提示词为例,介绍迭代创作过程,指出写不好提示词根源是难评估差距和调整。
Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车
Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。
AI算力大战打到太空!英伟达前脚H100入轨,谷歌TPU后脚上天,中国玩家笑而不语
英伟达和谷歌在太空算力布局上竞争激烈,英伟达H100已入轨,谷歌TPU预计2027年初上天,二者都想建吉瓦级数据中心。太空部署有成本、散热等优势,但也有工程挑战,而中国之江实验室星座已商用。
IDC 最新AI Infra报告解读|AI 云爆发的背后:AI 应用全球化势不可挡
近期 IDC 发布报告,显示亚太企业 GenAI 应用增长快,AI 产业从开发到应用落地。这催生 AI 原生云,GMI Cloud 等新兴厂商崛起。同时,企业面临算力管理成本高问题,推理需求重塑市场格局,为中企出海带来机遇。
仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架
阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进化生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进化新路径。