「两阶段训练策略」共找到 3222 篇相关文章
Marble登场!告别不稳定与变形,持久探索3D世界
李飞飞团队World Labs推出Marble并开放有限测试预览,基于图像或文本提示可生成3D世界,具有持久、稳定、风格多样等特点。用户能导出使用,在浏览器自由导航,虽有局限但潜力大。
DPad: 扩散大语言模型的中庸之道,杜克大学陈怡然团队免训推理加速61倍
扩散大语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克大学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。
产品经理必读:AI智能体架构指南——为什么能力强不等于用户爱用?
文章为产品经理打造AI智能体架构指南,以客服智能体为例,阐述四个架构层面决策,分析主流架构方法优劣,还指出构建智能体要注重信任策略,第二部分将探讨自主性决策和治理问题。
Claude Code凭什么牛?大模型团队天天用自家产品,发现bug直接就改了
Claude Code虽有争议,但很成功,4个月用户达11.5万。Claude Code负责人透露构建细节,如产品理念、评估标准、反馈机制等,还阐述编程领域变化、模型与工具共同进化等内容。
市值超1500亿!江西宜春小镇走出“光芯片之王”
在全球AI算力竞赛白热化阶段,天孚通信创始人邹支农凝视新获专利的光接收器组件。他从江西宜春高安农村走出,攻克日本垄断的光通信技术,将公司市值推至1548亿,还在家乡投资兴业。
中国AI芯片大突围,DeepSeek V3.1引爆算力革命
DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。
从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践
当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。
构建可靠AI Agent:从提示词、工作流到知识库的实战指南
本文阐述如何构建可靠、高效且可落地的AI Agent应用。随着LLM和工具调用标准化,开发核心竞争力转向提示词工程、工作流设计和知识库构建。还介绍各部分要点及安全策略,给出确定AI项目的方法。
上线 5 天狂揽 8.4K Star,Firecrawl 的 Open Lovable 火了,一键克隆任何网站。
Open Lovable是Mendable AI推出的开源项目,5天获8.4K Star成热门。它能秒克隆网站成可编辑React应用,免费开源。还对比了闭源Lovable,介绍其用户增长策略及Open Lovable使用步骤。
AI 产品定价指南:按量定价的卡点到底是什么?
本文编译 a16z 与 Scott Woody 访谈,探讨 AI 改变软件定价逻辑及企业应对策略,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点,指出按量定价的难点、适用模式及企业转型要点等。