「预训练时代」共找到 3294 篇相关文章
WithAnyone重磅开源:这可能是你见过最自然的AI合照模型
复旦大学携手阶跃星辰推出全新AI合照生成模型WithAnyone,它能生成自然、真实、毫无违和感的AI合照。该模型打破以往方法局限,当前ComfyUI版本已上线,还全面开源代码、模型权重等。
智源开源EditScore:为图像编辑解锁在线强化学习的无限可能
北京智源研究院团队发布 EditScore 高保真奖励模型系列,为图像编辑强化学习提供精确奖励信号。团队提出两步解决方案,开发出 EditScore 系列模型,其在多方面表现优异,还验证了两大应用场景,有深刻研究洞见。
王兴兴硕士论文惊现GitHub,宇树雏形那时候就有了
宇树科技CEO王兴兴近10年前的硕士毕业论文在GitHub被发现。论文提出电驱式机器人方案,奠定宇树科技雏形。其‘性价比’思想成公司立身之本,如今宇树估值百亿且将IPO。
2025 年 InfoQ 趋势报告:AI、ML 和数据工程
InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。
DeepSeek突然拥抱国产GPU语言!TileLang对标CUDA替代Triton,华为昇腾Day0官宣支持适配
DeepSeek v3.2开源TileLang版本算子引关注,其可对标CUDA替代Triton,还适配国产算力生态,华为昇腾官宣支持。TileLang由北大团队主导,提供不同层次编程接口,助DeepSeek提升性能。
对谈 Macaron 创始人陈锴杰:RL + Memory 让 Agent 成为用户专属的“哆啦 A 梦”|Best Minds
本文访谈 Macaron 创始人陈锴杰,探讨 RL+Memory 让 Agent 发展及 Macaron 产品。他强调 RL 在 Agent 开发重要性,介绍 Macaron 定位、特点、训练方式,还谈及社区设想、RL 应用及产品发展方向等。
从计算到存储,阿里云打通AI落地的“任督二脉”
在8月14日飞天发布时刻,阿里云发布通用计算、容器计算及存储服务三项产品更新,串联出AI落地业务场景完整路径,引导行业重新思考AI时代云基础设施的本质。
吴恩达:不理解计算机的工作原理,你不可能单靠 Vibe Coding 就走向卓越,基础知识依然至关重要
吴恩达指出懂AI的开发者供不应求,但计算机专业应届生失业率上升,因大学课程未跟上时代。他面试看重借助AI助手开发、运用AI基础模块构建应用等能力,强调基础知识仍重要。
Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘
人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。
开学了:入门AI,可以从这第一课开始
文章从生活小事引出AI相关知识,介绍了AI学习方法,包括掌握数学基础、编程能力,持续学习与实践。还提及AI现实挑战与机遇,回顾其发展历程,最后给学习者送上祝福与建议。