无损迁移」共找到 307 篇相关文章

算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理
开源动态8

别问树模型了!死磕结构化数据,清华团队把大模型表格理解推到极限

AI 时代处理结构化数据成痛点,LLM 大模型难以满足生产要求。清华大学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。

机器之心
算法论文8

只演示一次,机器人就会干活了?北大&BeingBeyond联合团队用“分层小脑+仿真分身”让G1零样本上岗

北大与BeingBeyond团队提出DemoHLM框架,仅需1次仿真演示就能生成海量训练数据,解决人形机器人移动操作数据效率低、任务泛化差、Sim-to-Real迁移难的问题,在仿真和真实机器人上验证效果良好。

量子位
开源动态8

1.58bit不输FP16!微软推出全新模型蒸馏框架,作者全是华人

微软推出蒸馏框架BitNet Distillation,实现几乎无性能损失的模型量化。它含三阶段,经实验在多下游任务表现近全精度模型,降内存开销、提推理速度,作者全是微软研究院华人。

量子位
7

AI 原生初创公司,都把钱花在了哪些 AI 产品上?

a16z与Mercury合作调研,基于超20万客户数据库,分析2025年6 - 8月支出模式,筛选出50家AI应用层公司。榜单揭示AI在产品与工作流的落地情况,显示早期创业公司愿买单的AI应用方向。

特工宇宙
算法论文8

Facet-0:NTU王子为团队让机器人在精密装配中「看得懂、插得准、出错能恢复」

新加坡南洋理工大学PINE Lab团队研发Facet - 0机器人基础模型,用于精密装配。它在五项计算机装配任务中平均成功率达82%,能让机器人理解接触状态、判断对错并改进。通过多阶段训练,降低人工干预率,提高失败恢复率。

机器之心
产品应用7

豆包工作体验:Agent 正在成为工作的新入口

豆包发布“豆包工作”,定位为独立办公 Agent 工作台。体验良好,能开项目、连办公应用。文章指出用户习惯迁移,Agent 成工作入口,还探讨了办公 Agent 的竞争点、权限问题、组织提效及人员角色转变等。

宝玉AI
推荐文章8

Loop Engineering 实战:实现从日志扫描到预发部署的全自主闭环

文章分享 Loop Engineering 实战经验,指出传统维护循环存在看不见、记不住、没闭环问题。介绍了从 Prompt 到 Loop 的四代 AI 工程化范式,阐述 Loop 原理、组件及落地实践,还提及范式迁移和踩坑教训。

阿里云开发者
开源动态8

Agent之间,有互联网了!

明略科技开源发布Octo,旨在构建开源可信的Agent协作网络,让人、Agent和外部工具进入同一协作系统。它有三个核心概念、六种协作模式、四个端,推动AI应用从个人工具向组织协作网络迁移

量子位
产品应用8

天下苦CUDA久矣,又一国产方案上桌了

AI开发中,国产硬件增多,但开发者仍依赖进口生态。KernelCAT作为国产AI Agent应运而生,它能开发高性能算子,在昇腾芯片测试中表现出色,还能助力模型在国产平台高效迁移,限时免费内测。

量子位