R1」共找到 1762 篇相关文章

新闻资讯7

AI 狂潮中,电子业破局:国产先进封装加速突围

AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。

芯师爷
算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理
算法论文7

Qwen3 变身扩散语言模型?不从零训练也能跑,30B参数创纪录

扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。

机器之心
新闻资讯7

xAI解散,但Grok还在上新,马斯克官宣新模型

xAI 解散、大批成员离职后,马斯克透露 Grok 最新模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能体 Grok Build 也备受关注。

机器之心
新闻资讯8

从被100家VC拒绝到英伟达、字节抢着投,AI视频独角兽CEO揭秘“奇葩”用人哲学:不招精英

Synthesia是专注企业级AI视频方案的平台,愿景是让会用PPT的人轻松做视频。创业初被100位投资者拒绝,获Mark Cuban支持后走上正轨。产品受众多公司使用,ARR1亿美元,还获英伟达、字节等投资,CEO用人不招精英。

AI前线
新闻资讯7

腾讯披露元宝已是TOP3应用

2025腾讯全球数字生态大会信息量大。腾讯元宝日活冲前三,混元3D建模精度提升3倍。C端产品逐步落地B端,如腾讯云CodeBuddy等。腾讯云还将带成熟生态出海,投资1.5亿美元在沙特建数据中心。

量子位
新闻资讯7

存储芯片领域又冲出一家IPO!年入37亿

AI驱动存储“超级周期”,行业巨头提价,国内存储芯片公司股价上涨。深圳晶存科技9月底递表港交所,此前募资超7.06亿,2024年末投后估值37亿。虽净利润为正,但经营现金流持续为负,全球嵌入式存储市场市占率约1.6%。

芯师爷
7

新国产GPU「曦望」,刚融了10个亿

国产GPU公司曦望Sunrise由商汤2024年底分拆独立,时隔半年完成近10亿融资。其产品曦望S1、S2已量产,S3在研发。两位联席CEO分别是百度元老王湛和AMD芯片老将王勇,核心团队规模小但成果显著。

量子位
新闻资讯7

十周前才写下第一行代码,如今颠覆 9 个行业?员工人均 10 万粉,00 后创业者狂言:我们将超越 OpenAI

本文聚焦 21 岁 00 后创业者 Roy Lee 和他的桌面 AI 助手 Cluely。该产品获高额融资、估值达 1.2 亿美元且已盈利,但也饱受争议。文中还揭秘其成功热度的关键、团队情况,探讨 AI 时代产品留存演变。

InfoQ
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型小如手机App

腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过多种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位