「生成式引擎优化」共找到 3506 篇相关文章
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
SGLang × RoleBasedGroup(RBG):打通大模型推理PD分离架构规模化落地的“最后一公里”
PD分离架构对大模型推理部署意义重大,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。
大语言模型(LLM)到底是怎么运作的?(配图通俗讲解)
文章先介绍条件概率,指出大语言模型预测下一个单词是条件概率问题,会计算所有可能单词的条件概率选最高的。还提到直接选最高概率会使内容单调,引出温度概念,它能调整概率分布影响抽样结果。
谷歌·搜索:献给AI的第一个「祭品」?
谷歌正用AI重塑搜索,AI Overviews和AI Mode改变传统架构,从信息入口变终点,侵蚀开放网站流量。虽在AI创新有进步,但搜索广告垄断及商业模式岌岌可危,2026年或不复往昔。
NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026
本文整理了NVIDIA Research科学家李柏依在ECCV 2026 Workshop的分享,针对机器人训练数据采集壁垒高的问题,介绍了两项解决多模态感知与灵巧操作数据难题的前沿研究。
光计算如何走向实际部署?清华、上交提出光计算走向实用化的技术路线图
传统电子计算算力遇瓶颈,光计算成为下一代算力新方向。清华与上海交大研究团队联合在Nature Nanotechnology发表研究,提出国际首个光计算实用化统一评价框架与技术路线图,为光计算落地部署提供明确指导。
翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”
前OpenAI安全研究副总裁翁荔在新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型在现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈。
用AI复制人脑可行!MIT论文估算500亿美元、10到25年可实现
美国麻省理工学院研究生艾萨克·弗里曼团队论文指出,大脑仿真正从梦想变为可量化工程问题。关键技术加速发展,成本降低、算力接近需求,未来或可用于医疗等领域。
Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台
Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,多Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。
把短视频做成流水线的AI剪辑神器
Pixelle-Video是一款AI剪辑神器,输入主题就能自动完成视频创作,零门槛。它采用模块化设计,流程清晰,各环节可灵活定制。支持多种AI模型、TTS方案,有丰富功能亮点。