「稳定性提升」共找到 3011 篇相关文章
编程 Agent 如何重塑工程、产品和设计
软件公司 EPD 目标是做出好软件,产出为代码。编程 Agent 让写代码变简单,使 EPD 角色定位改变,如 PRD 传统流程终结、瓶颈转向评审、通才更有价值等,各角色需适应新变化。
网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 大模型推理加速架构
网易游戏打造 Tmax AI 机器学习平台,但大模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。
告别死记硬背!SkillRL自动提炼Skills持续进化
大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。
机器人GPT时刻!英伟达WAM赋予全机器人零样本操作能力
英伟达发布世界动作模型 DreamZero,通过耦合视频生成与动作预测,让机器人有物理直觉,能在陌生环境完成复杂任务。它用异构数据学习,适配不同机体,还经优化实现高速推理。
“AI提高了我的生产力,但我更累了”
《AI疲惫是真实存在的,但却无人提及》一文爆火,引发开发者共鸣。专业程序员Siddhant Khare也有同感,他分析AI使人更累是多方面因素所致,还提出可持续工作方式,认为要知道何时停用AI。
可灵3.0系列模型正式上线:属于每个人的导演时代来临
可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。
Attention真的可靠吗?上海大学联合南开大学揭示多模态模型中一个被忽视的重要偏置问题
上海大学曾丹团队联合南开揭示Vision - Language Models中普遍的attention偏置问题,提出无需重训的去偏方法,在多模型、策略及基准上验证有效性,为多模态模型部署提供新思路。
Claude Code 之父分享 10 大使用技巧
Claude Code 创造者 Boris Cherny 分享团队使用技巧,如并行工作、先规划再动手、更新 CLAUDE.md 等 10 条经验,还提及打造自动化体系、提升 Prompt 水平等内容,强调多用多想提效。
如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证
大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。
苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!
苹果和谷歌官宣多年期合作,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及其云技术构建,为 Siri 等提供支持。此合作引发行业讨论,马斯克质疑其权力集中,也改变 OpenAI 在苹果生态的角色。