「后训练方法」共找到 4847 篇相关文章
ACL 2025 | AI字幕慢半拍,不知道大家在笑什么?新方法让同传性能直逼离线翻译
香港中文大学、字节跳动Seed和斯坦福大学团队提出SeqPO - SiMT框架解决同声传译“质量 - 延迟”权衡问题。该方法将同传建模为序贯决策过程,优化决策序列,实验显示其性能直逼离线翻译。
单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta
普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。
AI大模型浪潮下的认知重构:从一个数据老兵的转型思考
作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模及 AI 原生产品变化。
程序员从此不再写代码!红杉专访Codex团队,o3白菜价真相曝光
红杉专访OpenAI Codex团队,揭示AI编程未来。Codex从代码补全演化为智能体,强调委托心态,开发者从动手转向审核。还爆料OpenAI内部有递归自我改进的AI Alice。
深入体验 A2A SDK:一步步教你构建“服务化”的 Agent 系统
文章基于A2A最新Python - SDK,介绍将LangGraph的Agent通过A2A协议对外暴露并服务的方法,涵盖核心架构、概念、交互流程,以及A2A Server端、Client端实现和测试总结,还提及A2A优势。
12.1万高难度数学题让模型性能大涨,覆盖FIMO/Putnam等顶级赛事难度,腾讯上海交大出品
腾讯AI Lab与上海交大团队联合推出首个基于自然语言的数学定理证明框架与数据集DeepTheorem。12.1万道高难度数学“特训题”让模型定理证明性能大涨,7B模型性能比肩或超越现有开源和商业模型。
SQL玩转多模态AI,轻松搞定图片+文本混合搜索
在AI驱动智能商业时代,传统搜索系统难满足需求,AI检索系统又面临数据搬运和工具链割裂难题。本文提出用原生SQL实现多模态智能检索,基于PolarDB融合AI引擎,通过SQL调用服务,无需迁移数据与搭建独立服务。
200块的音箱,1000亿的生意
智能音箱曾是风口,后出货量下滑。小米靠低价音箱集成Mesh网关,撬动IoT业务,2024年创收超千亿。同时,IoT业务解决了小米线下渠道问题,其产品线思路转变也带来新增长。
中国半导体显示产业之父,将带出一个超级IPO
投资界消息,奕斯伟计算向港交所递交招股书,有望成“RISC-V第一股”。其掌门人为王东升,曾带领京东方走向全球霸主地位。奕斯伟计算聚焦RISC - V架构,获多轮融资,王东升还投资半导体产业链多企业。
实测对比!扣子空间播客功能完爆 NotebookLM,覆盖场景更大
多模态是大模型热门应用概念,文本生成语音赛道受资本青睐。作者实测对比扣子空间和NotebookLM,发现扣子空间播客功能更优,能精准拿捏尺度,覆盖场景大,还能做旅行攻略、生成网站等。