「自蒸馏微调」共找到 1410 篇相关文章
The Batch:841 | 大语言模型正在纠正历史遗留的不公
美国北加州旧不动产契约含种族歧视条款,虽已非法但人工筛查耗时久。斯坦福和普林斯顿研究团队微调大语言模型识别圣克拉拉县契约中的歧视条款,模型可理解上下文,结果经律师确认,研究成果已开源。
2K Star!颠覆PPT!这个560KB的HTML文件,把整个办公套件装进了一个文件里!
Bento是开源项目,把文档、编辑器等全打包进约560KB HTML文件,功能堪比PowerPoint。它数据纯JSON、支持AI协作与端到端加密协作,还自研多个引擎,有多种上手和与AI协作方式。
实测最强的Cowork Agent模型M2.7,这是龙虾最好的模型搭子
实测MiniMax新发布的M2.7模型,解决了Agent的笨拙感,是国内最强的Cowork Agent模型。它技能命中率高,能自进化,对办公场景做了优化,还能解决生产效率问题,加强了人设保持能力。
阿里达摩院开源具身大脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了
阿里达摩院开源RynnBrain具身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上超顶尖模型。具小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。
「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!
本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。
国际PC巨头入局,Violoop押注个人主权AI|甲子光年
Violoop获亿元级融资,产品计划9月16日众筹。它想让AI设备随使用更懂用户,提出“个人主权AI”,即个人掌握经验与改进能力。研发聚焦让AI理解人,设置主权边界,有三层自进化路径,还探索多终端应用。
最大开源第一视角数据集 EgoLive 来了,名校站台、近百家机构争相申请
今年4月京东开源业界最大人类第一视角数据集EgoLive,已获近百家机构申请。它用自研设备采集,经多模态处理,覆盖多场景任务。其数据用于JoyAI - RA训练,在真实场景验证效果好,还推动具身智能数据标准化。
影身智能完成多轮融资,用原生3D数据重新定义机器人认知|甲子光年
影身智能已连续完成多轮融资,累计近亿元。其以‘原生3D动态世界模型’为核心技术,采用与市场不同的‘升维’思路,用自研的‘影身360’系统采集3D数据,还落地柔性智造行业,目标是打造通用人工智能产品。
视频生成一长就漂移竟是前序帧「太干净」惹的祸!研究揭示共享噪声水平才是长视频稳定关键
自回归视频生成模型存在训推不一致导致的误差累积问题,使生成视频越往后越易出现时序漂移和画面崩坏。HiAR团队推出HiAR,通过共享噪声水平减少误差传递,还解决了动作僵化问题,实现分钟级无退化生成。
Unsloth让大模型跑在手机上!
Unsloth放出教程,可将其微调模型部署到Pixel 8和iPhone 15 Pro。用ExecuTorch技术优化,Qwen2 - 0.5B在旗舰机上表现流畅。教程介绍量化感知训练控制精度损失,还给出iOS和Android部署步骤及注意事项。