「AI模型训练」共找到 13906 篇相关文章

新闻资讯8

陶哲轩看傻:三破18年数学纪录!谷歌推出「AI爱迪生」,科研不再靠灵感?

5月中旬谷歌发布AlphaEvolve,30天攻克18年未解难题。它利用Gemini模型发现新算法,从AlphaGo获启发,能在编程空间搜索方案,或开启不靠‘灵感’的科学革命,还将改变科学家角色。

新智元
新闻资讯8

对话零跑汽车周洪涛、冯铭月:零跑世界模型的300天|甲子光年

本文是甲子光年对零跑汽车周洪涛、冯铭月的独家对话,披露零跑智驾从跟随策略转向押宝世界模型的研发过程、技术路线选择与普惠升级计划,还原零跑智驾超车历程。

甲子光年
开源动态7

AI 智能体界的 npm 来了!Vercel 推出 Skills.sh,欲统一智能体指令集

Vercel 发布开源项目 Skills.sh,为 AI 智能体打造“标准动作库”,让其通过命令行执行可复用操作。它是开放生态,开发者能定义、分享指令。项目获广泛关注,社区认为其实用性强。

InfoQ
产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
推荐文章8

想做成好的AI应用,先从把它砍成“一小时版本”开始「吴恩达老师开发心法」

吴恩达老师分享AI开发实用建议,若开发时间有限,应缩减项目范围,直至能在现有时间内完成。如他将“观众模拟器”项目精简,在短时间构建基础版本,获多方面收获。

AI寒武纪
开源动态8

终于!OpenAI 开源了2款模型:gpt-oss-120b 和 gpt-oss-20b

OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 开源模型,性能出色,如 120b 版本媲美 o4-mini,20b 版本能在笔记本甚至手机运行。采用 Apache 2.0 许可证,有多种特性与运行方式,还经安全分析。

AGI Hunt
新闻资讯7

MIT满分学霸掏空AI初创,谷歌24亿收购黑幕曝光!数百员工血本无归

OpenAI收购Windsurf在即,谷歌挖走其领导层和核心工程师,豪掷24亿美元。投资者、创始人和被选中团体获利,员工血本无归。谷歌并非首次如此,这揭示了硅谷AI人才金钱至上的趋向,冲击现有社会契约。

新智元
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
新闻资讯7

对话西工大徐韬:昇腾生态如何为AI创新装上涡轮增压?|甲子光年

本文讲述西工大徐韬团队与昇腾平台深度合作的故事。他们从算子研究攻坚底层技术,开发抑郁症初筛等系统。昇腾还助力教学,让学生实践操作。未来,更多人将参与国产AI源头创新。

甲子光年
开源动态8

开启RL Scaling新纪元,siiRL开源:完全分布式强化学习框架,支持超千卡规模高效训练

传统强化学习框架在模型和集群规模达上千块GPU时,存在扩展性瓶颈和效率低下问题。上海创智学院团队推出siiRL,采用全分布式架构和多控制器范式,解决传统框架痛点,在多方面验证了其高性能。

机器之心