B 站」共找到 870 篇相关文章

开源动态8

“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!

7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。

AI前线
开源动态7

数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~

Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。

PaperAgent
开源动态8

刚刚,国产AI自己造了AI,全球首例!

面壁智能实现全球首例国产AI造AI,用AI编写预训练框架ForgeTrain,性能超英伟达Megatron,还训练出MiniCPM5 - 1B模型。该模型可作桌宠,小尺寸高智能,还能自定义人格,提供工具链。

量子位
新闻资讯7

拉响紧急警报后,奥特曼再遭暗讽:孤注一掷,或将死无全尸!

在纽约曼哈顿的峰会上,Anthropic的CEO Amodei预言AI将使50%初级白领岗位被取代,提出「企业 - 政府 - 社会」应对模型。他警告行业风险,暗讽OpenAI和奥特曼,还表示Anthropic走B端差异化路线。

新智元
推荐文章7

OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态大模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。

PaperAgent
算法论文8

字节Seed提出序贯策略优化方法,突破同传“质量-延迟”权衡问题

AI字幕质量和延迟难平衡是业界老问题。香港中文大学、字节跳动Seed和斯坦福大学研究团队提出序贯策略优化框架SeqPO - SiMT,在70亿参数规模实现SOTA,翻译质量媲美Qwen - 2.5 - 7B离线水平。

量子位
算法论文7

经典ReLU回归!重大缺陷「死亡ReLU问题」已被解决

在深度学习领域,经典 ReLU 函数因简洁性等优势受青睐,但有「死亡 ReLU 问题」。德国吕贝克大学等机构研究者引入 SUGAR 方法,不牺牲 ReLU 优势解决该问题,还设计 B - SiLU、NeLU 函数,实验显示性能提升显著。

机器之心
新闻资讯7

奥特曼急了!OpenAI稳坐三年的王座,刚刚被Anthropic踹下去了

2026年5月Ramp数据显示,Anthropic企业市占率34.4%首超OpenAI的32.3%。Anthropic靠按量计费和AI Agent吸金,但也面临利益错配、体验下滑、成本上涨等问题,大模型竞争进入B端深水区。

新智元
开源动态8

可能是目前效果最好的开源生图模型,混元生图3.0来了

腾讯混元发布并开源原生多模态生图模型混元图像3.0,参数规模80B,是参数量最大的开源生图模型,也是首个开源工业级原生多模态生图模型,效果对标业界头部闭源模型。文中介绍其技术方案、测评效果等。

量子位
算法论文8

Kimi新架构让马斯克叹服!17岁高中生作者一战成名

17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。

量子位