大素数空隙」共找到 5055 篇相关文章

开源动态8

攻克模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0

9月19日,蚂蚁百灵模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。

机器之心
算法论文8

DPad: 扩散语言模型的中庸之道,杜克学陈怡然团队免训推理加速61倍

扩散语言模型(dLLMs)有全局规划能力,但存在计算冗余。杜克学陈怡然团队揭示其“草稿纸机制”,提出免训练方法DPad,结合现有技术,能在几乎无损精度下实现高达61.4倍推理加速。

机器之心
产品应用7

训练模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家

动视暴雪、斯坦福学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。

AIGC开放社区
算法论文8

检索做,生成做轻:CMU团队系统评测RAG的语料与模型权衡

CMU团队在最新ECIR接收论文中,系统评估RAG语料规模与生成模型规模替代关系。实验表明,语料扩容可让小模型追上模型,提升主要来自证据覆盖。研究为RAG系统提供更具性价比提升路径。

机器之心
算法论文8

上交 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布式推理系统,显著提升扩散语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理
新闻资讯7

Ilya尘封10年录音曝光!二入Hinton门下,竟坦言机器学习反直觉

新智元报道,博主曝光Ilya 2015年谈论深度学习的语音片段。数学出身的Ilya认为机器学习违反直觉,二与Hinton合作。他指出监督学习是最成功领域,还谈及神经网络目标函数、深度学习追求等观点。

新智元
算法论文8

一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题

DeepMind团队的模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。

机器之心
算法论文7

GPT-6要「活」了?MIT新作曝光,AI「自进化」不远了

麻省理工学院推出全新自适应模型框架「SEAL」,让模型从「被动学习者」变为「主动进化者」。网友猜测GPT - 6可能整合其能力,成为能自主学习的模型,研究虽有局限,但为模型自进化提供新路径。

新智元
新闻资讯7

对话上交程远:AI的终局不在云端,而在“感算一体”的物理世界

文章围绕端侧 AI 展开,以上海交通学程远研究为例,探讨其技术方向“感算一体”,还提及 Agentic AI 热潮,对比其与模型热区别,阐述端侧与云端关系,及光计算等底层硬件创新对智能设备的影响。

DeepTech深科技
推荐文章7

语言模型(LLM)到底是怎么运作的?(配图通俗讲解)

文章先介绍条件概率,指出语言模型预测下一个单词是条件概率问题,会计算所有可能单词的条件概率选最高的。还提到直接选最高概率会使内容单调,引出温度概念,它能调整概率分布影响抽样结果。

宝玉AI