「循环深度Transformer」共找到 1099 篇相关文章
OpenAI 内部揭秘:我们如何使用 Codex
文章揭秘 OpenAI 内部使用 Codex 的情况,介绍其在理解代码、重构迁移、性能优化等多方面的应用场景,还给出最佳实践,如用‘提问模式’开始、组织好提示等,展现了 Codex 强大的开发辅助能力。
让Agents更聪明,3招搞定记忆管理~
文章深度分析开源项目Memori,探讨Agent记忆管理。它将记忆分短期和长期,通过三个Agent协同工作实现长短期记忆功能,使记忆成结构化知识库,且能无缝衔接多种API。
刚刚,商汤内部两万字复盘曝光:多模态通往AGI核心路线首次公开
商汤科技联合创始人林达华撰写万字长文,剖析将「多模态通用智能」视为技术战略核心引擎的原因,探索组织及战略层面的思考。文章回顾商汤多模态之路,探讨多模态通向AGI的原因、构建路径等关键问题。
节目预告丨艺术⁺Talk—AI 艺术创作的边界探索
2025年AI融入艺术创作,艺术从业者面临诸多选择。此次Talk将围绕AI对艺术创作主权、表达路径与生存策略的影响展开对话,探讨艺术创作边界,还介绍了嘉宾、直播信息等。
字节跳动刚把自己招牌AI Agent开源了,可商用、超6000颗星
字节跳动招牌AI Agent扣子(Coze)开源且支持商用。它是开发平台,提供大模型、工具与开发模式,可视化一站式开发,有上百种模版,还介绍了无代码开发客服智能体的步骤及功能。
性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令
现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型。
对话 PyTorch 掌门人 Matt White:AI 应用应该做到“润物细无声”
近日,PyTorch 基金会执行董事 Matt White 在北京智源大会指出,开源虽形成‘良性循环’,但围绕‘开放’定义权的战争已打响。他还分享了对 PyTorch 发展、AI 应用等多方面的看法。
ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道
语音合成技术在大语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有零样本克隆能力。
李飞飞发布:全球首个多模态世界模型
李飞飞团队的World Labs发布全球首个多模态世界模型Atlas,是多模态自回归扩散Transformer,能相机控制生成、3D重建等,已向部分伙伴开放早期访问,未来将成底层模型。
一个月的活一周干完!英伟达世界模型训练速度飙升400%
英伟达世界动作模型 DreamZero 训练成本高、耗时长,无问芯穹与清华等推出的 RLinf 框架,从算子融合到 I/O 全链路系统级重构,使训练吞吐拉高近 4 倍,还解决多类性能瓶颈,保证训练效果。