后训练算法」共找到 4121 篇相关文章

产品应用7

Thinking Machines 发布 Tinker,重新定义 LLM 微调的边界

Thinking Machines 发布工具 Tinker,它是灵活的语言模型微调 API,采用‘责任分工’模式,让研究者专注算法创新,不用被运维细节拖累。此模式获 Karpathy 赞赏,目前 Tinker 开始内测,理念受欢迎。

AI工程化
新闻资讯7

文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了

开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件全丢,事不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。

InfoQ
算法论文7

实时生成视频!StreamDiT每秒16帧,单卡生成

现有文本生成视频模型多为离线生成,无法满足实时交互需求。加利福尼亚大学与Meta联合提出StreamDiT模型,采用流匹配等方法,蒸馏模型可单卡每秒16帧实时生成512p视频,不过仍有伪影问题。

带你学AI
开源动态8

让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方

上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。

OpenMMLab
新闻资讯8

王阳明心学,被Anthropic用来教Claude做人了

UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。

量子位
算法论文8

没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~

AI写代码能力提升,但打分方法僵化且成本高。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。

PaperAgent
开源动态8

刚刚,字节开源Seed-OSS-36B模型,512k上下文

深夜,字节跳动Seed团队开源Seed-OSS系列模型,含三个版本。其用12万亿tokens训练,在多基准测试表现出色。有灵活推理预算控制等特性,原生支持512K上下文窗口,基准测试成绩佳。

机器之心
算法论文8

这个AI精准模拟人类行为大脑状态,上Nature了

德国团队开发出人类认知通用计算模型Centaur,登上Nature。它基于Llama 3.1 70B,用5天训练,参数仅Llama的0.15%,能模拟人类在160项实验中的行为,性能超传统模型。

量子位
产品应用7

精准复刻!字节推出X-UniMotion实现高精度动作模仿合成

字节推出的X-UniMotion代表角色动画技术突破,提供统一运动控制系统,融合先进算法与操作界面,构建强大技术架构,能生成自然流畅角色动作,还介绍了其技术原理、演示对比等内容。

带你学AI
新闻资讯8

下一代超算,GPU得配QPU:老黄要把量子计算机和GPU「焊」在一起了

在VivaTech 2025会上,黄仁勋发布面向量子计算的革命性平台CUDA - Q。回顾英伟达CUDA - X套件及关键库,强调量子计算“拐点”,描绘QPU与GPU协同蓝图,宣布算法堆栈在Grace Blackwell 200加速。

AI寒武纪