不对称训练」共找到 3313 篇相关文章

算法论文8

相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作

S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。

量子位
开源动态8

抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。

量子位
开源动态8

英伟达韩松团队新作:具有后神经架构搜索的高效语言模型

英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。

量子位
新闻资讯7

因为用AI写代码,我在终面挂了 | 一个程序员的奇葩面试经历

外国小哥面试终面时,因表示工作优先用AI,5分钟后收到拒信。此经历在网上引发讨论,网友看法一,有人支招面试别贬低AI,也有人探讨AI在编程中的利弊,还提到AI辅助面试应用。

量子位
算法论文8

VLA统一架构新突破:自回归世界模型引领具身智能

北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。

机器之心
新闻资讯7

男子和老婆吵架,向AI求助推荐一条爬山线路散心被困悬崖

8月12日晚,杭州临安一小伙因和老婆吵架,听AI推荐前往童公尖,被困在海拔1300多米处。救援持续到次日凌晨。救援队称这是首起靠AI推荐线路导致的救援,提醒AI无实际经验且担责。

昆明走进自然户外
产品应用7

Thinking Machines首款产品重大更新:K2 Thinking、Qwen3-VL都可以微调了

由前OpenAI CTO创办的Thinking Machines Lab推出的首款产品Tinker API有重大更新。取消候选名单面向所有用户,还可微调Kimi K2 Thinking,新增兼容OpenAI API接口,支持Qwen3 - VL视觉输入,降低模型训练门槛。

机器之心
新闻资讯7

豆包手机被曝搭载锤子 SmartisanOS,二手价逼近8000元!罗永浩点赞字节:技术革命谁也挡

近日,豆包手机助手发售即被抢空。有博主发现其系统有锤子科技遗留字样。该手机官方价3499元,二手溢价超一倍。罗永浩点赞。过,它风波断,官方回应是技术预览版,面向普通消费者。

AI前线
开源动态8

社区供稿丨揭秘端到端文档OCR模型 POINTS-Reader

腾讯开源端到端文档OCR模型POINTS-Reader,论文被EMNLP 2025主会录取。它提出可扩展数据生成方案,具简洁、性能好、高吞吐量等特点,通过两阶段训练方案解决依赖蒸馏数据问题,在多基准测试表现佳。

Hugging Face
开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心