后训练系统」共找到 5093 篇相关文章

新闻资讯7

Kubernetes 引入量子支持的 TLS

Kubernetes推出增强功能,通过与KMS插件系统集成的混合密钥交换机制支持量子密码学,应对量子计算对加密协议的威胁,确保系统能随密码学标准演变灵活适应,此举措符合相关建议。

InfoQ
产品应用7

用 Docker 跑大模型训练,Unsloth 解决了环境配置难题

Unsloth AI 发布 Docker 镜像版本,解决本地训练大模型环境配置难题。拉镜像就能训练,依赖和示例 notebook 都打包好。使用简单,不过有暂不支持 Mac 系统等限制,单卡 NVIDIA GPU 场景较适用。

AI工程化
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
新闻资讯8

喂饱OpenClaw!北大中科院95打造星际超算,硬刚马斯克

中科天算与炎和科技联合宣布太空超算原型系统发布,完成太空算力与钙钛矿能源系统联调。全球算力需求爆发,地面超算受限,太空成核心战场,我国此次突破彰显创新魄力。

新智元
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
开源动态8

重磅!Meta开源通用神经输入系统!人人可用的非侵入式手环登场

Meta开源通用神经输入系统,用基于手腕的输入技术结合上下文感知AI带来新交互体验。关键技术EMG可读取大脑电信号,将其转成数字命令,系统表现优秀,为“隐形”人机交互奠基。

带你学AI
算法论文8

10步优化超越强化学习,仅需1条未标注数据!训练强势破局

无监督的熵最小化(EM)方法仅需一条未标注数据和约10步优化,就能显著提升大模型在推理任务上的表现,甚至超越依赖大量数据和复杂奖励机制的强化学习(RL)。EM为大模型训练提供了更高效简洁的新思路。

新智元
算法论文8

新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%

研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。

机器之心
开源动态8

史上最大高质量科学推理训练数据集开源,快速让Qwen3等变“科学家”

上海创智学院、上海交通大学发布开源科学推理训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位
新闻资讯7

梅西投了李飞飞,她转身买下了一家机器人“训练场”

足球巨星梅西旗下体育科技投资平台 Play Time 投资了李飞飞的空间智能企业 World Labs。该公司今年 2 月获 10 亿美元融资收购了 SceniX,以补足其机器人仿真短板。此前,Marble 虽能搭建训练场景,但没掌握物理规律。

InfoQ