「技术范式转换」共找到 3673 篇相关文章
OpenAI、Anthropic都开始押注FDE,FDE才是Agent时代的PMF范式?
5月初,Anthropic和OpenAI同日成立企业服务公司,核心组织形式都是FDE模式。FDE岗位需求飙升,成为科技行业抢手工作。前Palantir高管Bob McGrew深度复盘FDE模式,探讨其运作、团队构建等,还分析为何它是Agent时代的PMF。
极简RL新范式:一半算力刷新1.5B模型推理SOTA
过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。
中国机器人产业生态营在首钢园开营,构建产业协同新范式
10月30日,中国机器人产业生态营在首钢园开营,由首程控股发起。其整合多方资源构建闭环式创新生态,旗下基金已投资多家企业。生态营学员多元,罗振宇进行AI夜话分享,后续还有专家授课。
全新范式—让开发不再有门槛:云赛空间开发者沙龙活动回顾
2025年10月27日,上海云赛空间举办开发者沙龙。微软MVP胡浩、张欣、徐庭等分享见解,演示AI降低开发门槛、实现人机共创等,最后还进行了圆桌讨论,探讨AI时代开发相关问题。
超越对数似然:模型能力连续体下的监督微调新范式
论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型后训练提供新优化方向。
轻量高效,即插即用:Video-RAG为长视频理解带来新范式
现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。
ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式
人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。
KV-Cache 实战策略:生产环境中的分页、固定与复用技术解析
在大语言模型推理场景中,KV - Cache 是平衡性能与成本的核心技术,但生产环境中面临诸多问题。本文聚焦其分页、固定与复用三大战术,结合原理、实践与案例,为开发者提供解决方案,还探讨了未来演进方向。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
谷歌技术报告披露大模型能耗:响应一次相当于微波炉叮一秒
大模型耗电舆论高,谷歌用数据还击。谷歌首席科学家称Gemini能耗低于预期,一年间能耗降至1/33,碳排放降至1/44。谷歌用更全面指标计算能耗,还从多方面优化使Gemini能耗降低。