从零训练」共找到 4909 篇相关文章

推荐文章7

大厂离职后,白天是保安,夜里是 AI 创造者

本文讲述杨晨大厂运营离职后成为保安,白天观察人间百态,夜里用AI搞创作。他用AI为家人、朋友做工具,还帮公司做定制化工作流,赚了点小钱。他也想记录普通人故事,认为大家可借AI改变生活。

特工宇宙
开源动态8

YC 开源自家 Harness,3 天斩获 3.9k Star,QM 如何划清 Agent 的权限边界

YC开源的QM项目上线3天获3.9k GitHub Star,定位企业级Agent Harness,解决AI规模化落地管理难题。它补齐企业团队刚需能力,设计贴合企业规则,解决隔离与协作、权限管理问题,顺应行业拼模型到搭骨架的转变。

AI科技评论
推荐文章8

拒绝视频生成,深度跃迁提出具身基座模型全新路线

深度跃迁发布世界动作模型 DELE - w0.5,放弃基于视频生成模型的路线,训练时联合学习动作与未来世界表征,推理时移除该表征分支。在真机实验中表现超基线,具跨背景泛化能力,为世界模型提供新思路。

机器之心
新闻资讯7

AI PC进入爆发期,国产芯片能否在其中分得一杯羹?

AI云端走向端侧,AI PC迎来爆发期。Arm虽有结构性优势,但在PC端进展慢。此芯科技推出此芯P1,联合多方打造开放平台,推动标准化和生态建设,产品也不限于AI PC,未来有望为国产芯片争得话语权。

芯师爷
开源动态8

登上Nature子刊!Meta脑机接口重大阶段性进展,超高实时解码准确率

Meta在非侵入式脑机接口研究取得重大进展,Brain2Qwerty v2能原始脑信号实时解码句子,平均词准确率达61%,最优78%。研究团队开源训练代码,数据集也同步开放,但应用于临床仍面临精度和设备限制。

机器之心
产品应用8

GLM-5正式发布,744B参数,对标Claude

GLM-5正式发布,对标Claude,参数355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。

AI工程化
产品应用7

500万次围观,1X把「世界模型」真正用在了机器人NEO身上

1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖大规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务上表现不错,但精细操作有挑战。

机器之心
开源动态8

单卡可跑18万原子!分子模拟的“规模焦虑”该终结了

至知创新研究院UBio团队发布的UBio-MolFM v1.5,是可进行分子动力学模拟的机器学习原子间势函数。它在精度和规模上有提升,实测中表现优于经典力场,架构、数据和训练都有创新,误差降45%,速度提8倍,现已开源。

量子位
开源动态8

5秒出4张2K大图!阿里提出2步生成方案,拉爆AI生图进度条

阿里智能引擎团队针对Qwen最新开源模型,将SOTA压缩水平80 - 100步前向计算骤降至2步,速度提升40倍,5秒可出4张2K高清大图。已发布Checkpoint,集成到呜哩AI平台。文章还分析传统蒸馏方案问题并介绍团队改进策略。

量子位
推荐文章8

高性能计算群星闪耀时

本文介绍了高性能计算(HPC)在大模型时代的重要性,以及清华高性能计算团队在HPC及相关领域的研究与实践。如郑纬民带领团队突破存储技术,陈文光、翟季冬等助力大模型训练,武永卫团队优化推理,张悠慧探索类脑计算。

芯师爷