训练资源」共找到 2483 篇相关文章

算法论文7

苹果提出新型反向传播:一台iPhone 15 Pro Max就能微调LLM

苹果提出内存高效型反向传播(MeBP),可在内存使用量和计算时间上比零阶优化(ZO)有更好权衡,收敛更快、性能更优,还在iPhone 15 Pro Max验证其有效性,且公开了实现链接但目前为空。

机器之心
新闻资讯3

国外网友疯传DeepSeek R2/R3/R4 炸裂突破,超越传统的「跨因果超矩阵」,并在训练过程中自发产生了R5……

国外网友疯传DeepSeek R2到R5的“重磅”消息,爆料内容层层递进且玄幻离谱。Anthropic联合创始人评价有认可也有轻视。当下闭源模型各领风骚,开源阵营期望集中在DeepSeek R2,应平常心看待传言。

AGI Hunt
推荐文章8

工作流的 Skill 怎么写?从 7 个顶级 Skill 中提炼的模式与最佳实践

文章介绍工作流 Skill 写法,涵盖定义、Frontmatter 写法、5 种核心设计模式、通用写作技巧、模式选择决策树、快速上手模板及参考资源,还给出 7 个 Skill 速查表。

阿里云开发者
新闻资讯7

刚刚,OpenAI宣布关闭Sora

OpenAI宣布关闭Sora,此前其下载量下降、留存率低且成本高。有观点认为这是为聚焦下一代模型,释放资源;还有称是战略转移。迪士尼此前投资10亿合作,现放弃交易。

机器之心
7

突然变强!速度翻4倍,GPT Pro惊现「神级」操作,网友怀疑GPT-5.5已就位

OpenAI悄悄完成GPT Pro模型升级,其速度提升、视觉理解能力增强。同时,代号「Spud」的GPT - 5.5已完成预训练,发布在即,AI竞争将更激烈。

新智元
新闻资讯8

寻找最强具身大脑!全球机器人顶会ICRA开启报名,智元全程陪跑带你拿奖

由智元主办的AGIBOT WORLD CHALLENGE @ICRA 2026赛事开启报名,设推理 - 操作和世界模型两赛道。智元提供顶配硬件、仿真平台、数据集和基线模型,还有超百万美元奖金与资源,助力开发者。

量子位
开源动态7

Kimi K2基于DeepSeek V3构建

从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。

AI寒武纪
新闻资讯7

Anthropic联创公开劝退套路码农!94%编程将被接管,去学点哲学吧

Anthropic联创Jack Clark在峰会上称大学生应避开「套路化编程」,未来需跨学科综合、分析思考能力。Anthropic雇哲学家训练Claude,工程师工作转向管理AI智能体,AI接管编程趋势明显。

新智元
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
产品应用7

grok 4一图流

文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。

AI寒武纪