「后训练技术」共找到 6037 篇相关文章
Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局
Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合多种控制信号,实验效果良好。
从被吐槽“套壳中国大模型”到自研封神!首次揭秘Cursor背后极速代码Agent如何对标GPT5.1 Codex,生成效率提4倍
10月29日,Cursor 2.0发布Composer大模型,效率约为其他模型四倍。开发者分享其成极速代码Agent方法,如强化学习、平衡训练与推理负载等,还提及未来方向及研发反思。
谷歌Ironwood架构TPU v7:用AI造AI,撼动英伟达芯片帝国
11月25日谷歌云发布第七代定制芯片Ironwood,由AlphaChip设计。它以9.6 Tb/s光互联带宽和1.77 PB共享显存池重构大模型推理硬件基准,挑战英伟达芯片地位,展现AI算力竞争新趋势。
这下Altman急了,OpenAI紧急启动「红色警报」
ChatGPT三周年后,Altman宣布OpenAI进入红色警报状态,调集资源改进ChatGPT。此前谷歌曾因ChatGPT威胁发布红色警报,如今谷歌等对手快速追赶,OpenAI多产品后续乏力,还面临增长与融资压力。
英伟达Run:ai没做到的,被华为开源方案实现了
传统存储难满足AI需求,存储需向‘智能存储’演进。华为数据存储团队推出系列产品和开源工具链,其Flex:ai对标Run:ai,更开源底层,能解决行业算力痛点,已在医院场景落地。
AI 圈现“教科书式”骗局:对外伪造千亿估值,对内裁员、四次爽约,投资人员工双双被套
2025年初,Infinite Reality宣布获30亿美元融资,自报估值飙升至155亿美元,引发质疑。其高估值存疑,30亿美元融资真实性未知,CEO履历也有疑点。11月股东会称33.6亿美元投资或不到账,还取消股份回购,已四次食言,目前遭监管调查。
LLM 没意思,小扎决策太拉垮,图灵奖大佬 LeCun 离职做 AMI
图灵奖得主 Yann LeCun 宣布年底从 Meta 离职创业,聚焦高级机器智能研究项目 AMI。他离职是因与 Meta 在 AI 发展路线上冲突,且不满 LLM,坚持基于“世界模型”的下一代 AI 技术。
210亿美元的幻觉?奥特曼投了一家核能初创
AI热潮下,Oklo核能初创靠概念市值达210亿美元,投资人是奥特曼;而从SpaceX离职的工程师创立Quilter,让AI画电路板,几分钟完成工程师三天工作,二者代表造梦与造物两种姿态。
Meta通过简单算术解锁LLM SoTA性能
大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。
和快手聊了之后才知道,传统搜索早变天了
文章从工程师视角剖析现代搜索,指出传统搜索难适应多模态内容世界。快手推出 UniDex 和 UniSearch,前者变革搜索倒排,后者为统一生成式搜索架构,二者成快手新一代工业搜索‘双引擎’,有广阔应用前景。