「内容策略」共找到 1673 篇相关文章
我写 nano banana pro 提示词时的原则和策略
作者分享写 nano banana pro 提示词的原则与策略,原则是做成模板、结合模型能力;策略是先跑通原型再抽象成模板;不过度精简提示词,还介绍用 GPT-5.1 等工具辅助。
稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow
本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。
AI侵权愈演愈烈!全国首部“AI生成内容合规”标准欢迎参与起草
近期AI侵权频发,暴露AIGC技术下沉应用危害。中国电子商会等联合起草全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》,规范合规要求,还给出四大核心路径解决企业痛点,并阐述标准价值,现公开征集起草方。
研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现
强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。
刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次
Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。
如何破解内容安全“不可能三角”?快手王东旭:把组织从“固态”变成“液态”
快手内容安全团队负责人王东旭在AICon大会拆解“人机协同”破解内容安全“不可能三角”。他提出组织从“固态”转向“液态”,构建“AI合成旅”,还阐述产运研等岗位职能跃迁及协同模式升级,强调速度是护城河。
我做内容的10条私藏方法论,今天都拿出来分享给你们了。
数字生命卡兹克作为AI领域小有名气的创作者,分享10条内容创作方法论。包括心法上强调活人感、真诚和价值观;战略上重视选题、专业性;技法上用故事思维创作;修炼上关注评论区和数据分析。
Skywork AI | 发布Super Agent,一站式搞定写作、开发、分析与创意内容生成
去年谷歌定义了Agent,如今随着大模型发展其能力升级。Skywork AI推出Super Agent平台,有5个专家AI agent和1个通用AI agent,能生成多类型内容且支持溯源。它突破行业瓶颈,还开源相关框架和MCP。
如何破解海量内容审核难题?快手安全大模型技术探索与应用实践
在数字内容爆炸式增长下,传统内容审核模式难应对挑战。快手安全算法中心负责人刘梦怡分享自研多模态大模型技术方案与应用实践,涵盖架构、数据、训练等,还介绍审核智能化应用及未来展望。
Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍
Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。