「内容创作」共找到 1102 篇相关文章
最具争议性研究:大模型中间层输出可 100% 反推原始输入
意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。
OpenAI内部路线图精简纯享版
这是OpenAI内部路线图精简版,包含自动化AI研究员目标、五层安全策略、产品向平台与AI云迈进等内容,还涉及算力投入、新公司结构、非营利组织资本部署及科学发现时间表。
1300亿美元,买断AGI未来?OpenAI完成5千亿股改,奥特曼0股权
OpenAI完成架构重组,非营利的OpenAI基金会手握1300亿美元股权掌控营利部门。CEO奥特曼直播分享诸多重要内容,如算力目标、研发自动化AI研究员计划等,还谈及平台战略、隐私等议题。
这个百万月活的 AI 社区,做成了「二次元版 Sora」
文章介绍了百万月活的AI社区「捏Ta」,它类似「二次元版Sora」。其独特之处在于受年轻人喜爱、规避真人肖像问题、玩法多样。产品功能降低创作门槛,覆盖全流程,形成活跃社区生态。
深度拆解,硬核解构,揭开vLLM推理系统实现高效吞吐的秘籍
文章深度拆解 vLLM 推理系统,介绍其核心组件和高级特性,包括推理引擎流程、调度机制、高级功能等,还提及系统扩展、分布式部署、性能测量等内容,助力读者理解推理引擎工作原理。
Karpathy 评 DeepSeek-OCR:分词器必须消失!马斯克:光子才是 AI 的终极语言
Andrej Karpathy 发长文讨论 DeepSeek - OCR 论文,提出图像输入比文本更高效,还表达对分词器的厌恶,认为其必须消失。马斯克称 AI 主要交互将是视觉。开发者分享实践经验,也有人提出质疑。
一篇92页大模型Vibe Coding技术全面综述
中科院计算所&杜克大学发布首篇Vide Coding技术全面综述。介绍以“氛围/结果”为导向的Vibe Coding开发范式,含技术分类、能力分析、开发模式、数据模型等内容,还提及价值及反馈回路等。
听说,大家都在梭后训练?最佳指南来了
大模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。
腾讯混元开源AI绘画新框架:24维度对齐人类意图,让AI读懂复杂指令
腾讯混元团队开源PromptEnhancer框架,通过“思维链提示重写”提升AI绘画文本 - 图像对齐精度,复杂场景准确率提升17%以上。还开源高质量基准测试数据集,为研究提供支撑。
EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token?
近年来,大型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。