SFT训练集」共找到 2539 篇相关文章

产品应用7

“客户测950,不到一周下单了”,DeepSeek V4 逼出昇腾真功夫

昇腾计算业务副总裁张良透露昇腾近期销量好、认可度提高,大量客户基于其做训练。DeepSeek V4 考验昇腾,其超节点产品均支持。昇腾还对芯片体系和软件栈升级,拒绝仿 CUDA,坚持自主构建生态。

AI前线
算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
新闻资讯8

Google悄悄下了一盘大棋:一天三个端侧AI项目同时爆发

Google 一天内三个端侧 AI 项目爆发,包括离线听写 App Eloquent、端侧 AI 示例 AI Edge Gallery 和端侧大模型推理运行时 LiteRT-LM。云端大模型竞争趋同,端侧 AI 是差异化战场,Google 全栈布局有优势。

AI Reading Hub
产品应用8

安谋科技Arm China“玲珑”VPU IP来了!瞄准这些应用场景

安谋科技Arm China推出面向AI应用的新一代VPU IP——“玲珑”V560/V760。该产品性能硬核,是“六边形战士”,高性能、高鲁棒性等六大特性于一身,已完成首批客户授权,助力AI时代视频处理。

芯师爷
开源动态8

阿里达摩院开源具身大脑基模:3B激活参数性能超越72B,转身就忘事的机器人有救了

阿里达摩院开源RynnBrain具身大脑基础模型,全系列7个。它是业界首个有 时空记忆的模型,在20项具身Benchmark上超顶尖模型。具小而美优势,训练用自研架构提效,数据丰富,输入输出灵活。

量子位
算法论文8

大道至简,何恺明团队新作pMF开启像素级「无潜、单步」生成范式

何恺明团队新论文提出用于单步、无潜空间图像生成的pMF框架,直指主流扩散与流匹配模型通病。该框架将v、u和x三个场关联,训练网络把噪声输入直接映射为图像像素,实验表现强劲。

机器之心
新闻资讯7

昆仑万维方汉:通用Agent是伪命题,AI Office仍有存在空间丨MEET2026

昆仑万维董事长兼CEO方汉在MEET2026提出新视角,认为Agent是可验证过程的自动化系统,擅长复制流程。其判断大模型从‘背答案’到‘背过程’跃迁,Agent先落地AI Office,重塑组织,人类成过程架构者。

量子位
新闻资讯7

突发!英伟达H200对华解禁,老黄赢麻了

特朗普拍板允许英伟达向中国出售H200,美确保“代差优势”,还抽25%分成。H200性能是H20的6倍,虽落后最新架构,但适合训练推理,此决定或为英伟达带来巨额销售额。

新智元
新闻资讯8

英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛

本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。

新智元
算法论文8

“最强具身VLA大模型”,究竟强在哪儿?

机器人基础模型π*0.6刷屏,能让机器人高效完成多项任务。它引入Recap学习法,突破传统模仿模式。其核心方法RECAP让VLA用奖励反馈和人类介入训练,还能从异构数据学习,实现自我进化。

量子位