「模型调度系统」共找到 8834 篇相关文章
刚刚,Meta宣布正式成立「超级智能实验室」!11人豪华团队首曝光,
据彭博社消息,扎克伯格在内部备忘录宣布重组AI团队,合并到新成立的「Meta超级智能实验室」,由Alexandr Wang领导,还曝光11位从OpenAI等挖来的人才,将致力于开发Llama系列模型等。
使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护
作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。
华中农大“魔改”芯片电镜,揭示共生固氮暗藏百年的秘密
华中农业大学苏超和刘培文教授团队“魔改”芯片电镜,构建三维显微观测系统,揭示根瘤菌进入宿主细胞路径,发现果胶裂解酶作用,该技术在植物科学属首次应用,有望助农业减氮肥。
刚刚,DeepSeek梁文锋入选Nature年度十大人物!被称为「科技颠覆者」
《自然》评出2025年度十大科学人物,DeepSeek梁文锋入选,被称为「科技颠覆者」。他的公司发布的R1模型功能强大、价格低廉,训练成本低,还开放权重,为研究者提供经验,其成果已融入国人生活。
刚刚,Anthropic联合创始人在梵蒂冈讲了什么?
教皇发布人工智能通谕,Anthropic联合创始人Chris Olah受邀发言。他指出实验室激励与正确行事有冲突,描述了AI模型特点,还提出教会应发声的三个问题,引发社区不同反应。
Agent = Model + Harness,一个可能成为2026年出圈的新概念
文章提出新概念Harnesses Engineering,认为Agent = Model + Harness,阐述了Harness的作用、核心组件,还提及模型训练与Harness设计的耦合及Harness工程未来,指出需‘Harness思维’让AI驱动工业革命。
DeepSeek-R1 更新,思考更深,推理更强
DeepSeek R1 模型完成小版本升级至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。
SRO赋能Qwen-2.5-VL推理性能飙升16.8%
文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。
备受Meta折磨,LeCun依旧猛发论文!新作:JEPAs不只学特征,还能精准感知数据密度
备受Meta审核规定“折磨”,LeCun仍发新论文。其团队发现自监督模型JEPAs学会了数据“密度”,打破学界以往认知。还提出JEPA - SCORE工具,经多组实验验证其效果。
泛化性暴涨47%!首个意图检测奖励范式,AI工具爆炸时代意图识别新解法
随着大模型和工具增长,AI 助手意图识别遇新挑战。腾讯 PCG 团队用强化学习等方法,提升模型泛化能力,还从多方面剖析优势,最后提出未来研究方向。