「从零训练」共找到 4923 篇相关文章
近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角
宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。
2025甲子Cool Vendor人形机器人大模型领域报告 | 甲子光年智库
甲子光年智库发布《2025甲子cool vendor人形机器人大模型领域报告》。当前人形机器人产业迎来关键转折点,产业链层级完整,大模型解决落地难题,应用场景升级。报告还呈现了产业链现状与趋势。
刚刚,全球首个GB300巨兽救场!一年烧光70亿,OpenAI内斗GPU惨烈
为争夺有限GPU,OpenAI内部争斗激烈,2024年算力投入70亿美元仍不够。微软发布全球首台GB300超算专供OpenAI,可让万亿LLM数天训完。OpenAI建立资源分配机制应对挑战。
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。
大模型幻觉检测新方法:实时高亮不确定内容
来自苏黎世联邦理工学院等机构团队,开发流式幻觉检测器,能在生成过程中即时标记幻觉实体。核心是识别具体“实体”是否虚构,实验表现出色,团队已将数据集和代码开源,有局限但应用前景好。
AlphaGo作者领衔,8个机械臂协同干活0碰撞,DeepMind新作登Science子刊
DeepMind等机构成果RoboBallet登Science子刊。它将图神经网络用于强化学习,可控制8个机械臂协同无碰撞工作。核心是结合图神经网络与强化学习,解决多机器人协作复杂问题,实验表现出色。
2025年8月全球新媒体艺术盘点
MANA平台8月全球新媒体艺术盘点,涵盖20件来自多国的作品,有荷兰模拟雷暴的艺术晚宴、中国探讨具身智能的作品等,涉及多领域创新,展现新媒体艺术多元魅力。
斩获6.6K star!!再见了U盘、PE盘,一键重装Windows/Linux,几十种系统随便换,真绝了!
介绍GitHub开源重装神器`reinstall`,它能跨系统无门槛重装,支持多系统,自动处理网络驱动,适配性强。安装使用简单,从用户痛点出发,是综合性VPS管理工具。
00后MIT华人女生辍学创业,已融1.5个亿
00后华人女生Jessica Wu从MIT辍学,创立Sola Solutions,定位RPA界Copilot,获2100万美元融资。公司用LLM和计算机视觉构建自动化流程,已应用多行业,收入增长快。
震撼,世界模型第一次超真实地模拟了真实世界:谷歌Genie 3昨晚抢了OpenAI风头
昨晚谷歌DeepMind宣布Genie世界模型到第3代,能通过单个文本提示词创建交互式、可玩环境。它在多方面优于前代及其他模型,具备构建完整世界能力,但也存在动作空间有限等局限,未来应用值得期待。