自确定性」共找到 1088 篇相关文章

开源动态8

连续回归的dots.tts:小红书开源语音合成模型「基座」

语音合成赛道发展如早期大语言模型,路线未收敛。小红书与上海交通大学合作开源的 dots.tts,是 20 亿参数、全连续、端到端回归 TTS 基础模型,有准确度高、可扩展等特点,还开源了代码。

机器之心
算法论文8

Self-Forcing++:让回归视频生成模型突破 4 分钟时长极限

加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。

机器之心
算法论文8

告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性

文章指出LLM推理非确定性根源并非GPU并发和浮点非结合性,而是批大小变化致核函数非不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。

深度学习自然语言处理
新闻资讯7

一手奶瓶一手键盘!新手宝妈产假氛围编程,研实用家庭App

新加坡宝妈Laura Zaccaria产假研家庭餐食规划App。她无编程背景,靠Cursor等工具学习。AI迭代快,她意识到要跟上,产假成我进化契机,提醒大家学习才能不被时代抛下。

新智元
算法论文8

五倍推理加速,激发回归潜能,苹果新工作让LLM预测未来

近年来回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。

机器之心
新闻资讯7

复盘小鹏机器人风波:当一个机器人需要“证清白”|甲子光年

本文复盘小鹏机器人IRON风波,从科技日发布现场无人质疑,到网络舆论质疑造假,何小鹏亲下场证。还分析了公众质疑原因,介绍机器人技术,指出行业应回归应用本质,小鹏IRON将优先进入商业场景。

甲子光年
算法论文8

SPIRAL:零和游戏对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在零和游戏对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
算法论文8

理解帮助生成?RecA监督训练让统一多模态模型直升SOTA

统一多模态模型在视觉理解和生成能力上不平衡,常理解强但生成弱。本文提出重建对齐(RecA)监督后训练方法,不改动架构,用未标注图像训练,在多模型实验中提升性能,部分达SOTA。

机器之心
新闻资讯7

小扎不死心Manus“研”了一个,但模型用的Claude……

Meta推出智能体平台Hatch,功能类似Manus,开发阶段用Claude,计划正式上线时切换到研模型Muse Spark,10月推出新模型Watermelon。Hatch注重消费数字生活,与Meta社交生态深度绑定,高端订阅有默认分发优势,但面临真实环境考验。

量子位
新闻资讯8

马斯克生日惊喜!全球首例Model Y无人「驾交付」,30分钟见证历史

昨天,一辆特斯拉Model Y从得州超级工厂无人驾,最高时速115公里,30分钟到车主家门口,完成人类首次工厂到用户的闭环交付。马斯克激动祝贺,此场景复杂度超竞争对手。

新智元