「训练技术」共找到 4641 篇相关文章
陈大年复出,入局大模型
国产大模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。
马斯克点赞的APP来了!刚下场视频世界模型,就拿下评测第一
实时视频世界模型成热门,Loopit发布的实时互动世界模型Zing - 0.5在评测中获第一且已开源。该公司提出独特观点,认为实时视频非世界,互动应“模应一体”,还指出抵达端到端终局的新路径。
为什么 Agent Memory需要 AML:看 AML “变量控制”的工程设计
传统 Agent 记忆评测有水分,近日放榜的 Agent Memory Leaderboard (AML) 通过严格控制变量构建盲测管线。文章从技术架构深拆其工程细节,还分析了首期榜单,指出其重构评估变量的价值。
2026CSDI:AGI前夜,属于懂Agent、更懂模型的长期深耕企业
本文围绕2026年AI行业发展展开,指出竞争基本单位正从模型变为体系,AGI成组织目标,同时介绍了算力、数据等核心要素变化;还提及Agent与模型关系及编程新范式,最后宣传了2026CSDI峰会。
离开OpenAI和Google后,两位大模型核心负责人决定卷下一代架构
曾是OpenAI的「强化学习最大主义者」Jerry Tworek,与谷歌Gemini预训练负责人Rohan Anil,共同创办Core Automation。他们探讨当前AI路线问题,认为下一代架构要能持续学习,还计划打造自动化AI实验室。
AI终于“长”进机器人身体里!机械臂学会用触觉思考
香港科技大学申亚京教授团队研发出具身机器人手臂 EmArm,实现亚毫米级触觉定位与实时‘感知 - 行动’闭环。研究还提出‘感知 - 驱动’一体化算法,为打造物理 AI 机器人提供可扩展技术路径。
离大谱!15k Star book-to-skill,我惊到了!!!
book-to-skill是将书籍、文档目录或多份资料转换成Agent Skill的命令行工具。它把资料拆成可按需加载的知识资产,有按需加载章节等优势,适合将常用知识编译成技能,不过也有一定局限性。
Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了
7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的迭代」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。
刚刚,国产Agent模型闯入全球第一梯队!限时免费
昆仑万维发布SkyClaw-v1.0及其轻量版SkyClaw-v1.0-lite Agent模型,性能达全球第一梯队,价格仅主流顶尖模型一半甚至更低,适配主流Agent框架,还兼容OpenAI接口,现限时免费,后续将逐步开源。
马斯克诉OpenAI案终落幕:1500亿索赔因“告晚了”被驳回
2026年5月18日,“马斯克起诉OpenAI”案裁决,OpenAI无需担责,马斯克诉求被驳回,原因是诉讼时效已过。这场官司拉扯两年多,索赔从数十亿增至1340亿美元。庭审暴露双方问题,后续资本战将开启。