deepseek - r1」共找到 743 篇相关文章

算法论文8

测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因

Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证表明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。

PaperAgent
开源动态8

单卡2秒生成一个视频!清华联手生数开源TurboDiffusion,视频DeepSeek时刻来了

清华大学TSAIL实验室和生数科技联合开源视频生成加速新框架TurboDiffusion,能让视频生成在保证质量下最高提速200多倍,单张显卡就能运行,还整合四项关键技术,有诸多应用意义。

开源星探
开源动态8

欧洲版DeepSeek发布Mistral 3系列模型,多模态端云生态,无差别商用交付给全球开发者

欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。

AIGC开放社区
新闻资讯8

AI圈“集体开大”!DeepSeek、Claude带头,智谱、阿里、蚂蚁、智源都“卷”起来了

双节前最后一天,AI圈“卷”疯了!智谱发布并开源GLM - 4.6,是国内最强Coding模型;阿里介绍视、听、说全模态同传大模型Qwen3 - LiveTranslate - Flash;蚂蚁开源万亿参数推理大模型Ring - 1T - preview;智源开源跨本体基座大模型RoboBrain - X0。

AI科技大本营
产品应用8

世界模型的DeepSeek时刻!魔芯Flash World Model降本70%,跑出50FPS实时交互

魔芯科技发布全球首个超高帧率交互式世界模型 MoWorld,无需高端 GPU,实现影视级画质、50 FPS 实时交互,降本 70%。其技术架构先进,产业化路径清晰,获过亿美元融资。

机器之心
算法论文8

ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速

琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。

机器之心
新闻资讯8

斯坦福423页AI报告出炉!中美差距仅2.7%,清华DeepSeek冲进全球前十

斯坦福发布「2026年AI指数报告」,长达423页,揭示全球AI产业版图。指出中美AI模型性能差距仅2.7%,AI发展迅速但人类管控能力未跟上,还呈现出就业、算力、应用等多方面趋势。

新智元
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗大模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗大模型或成最优解,它参数量大,在多评测中登顶,技术优势明显。

机器之心
开源动态8

清华系DeepSeek时刻来了,硅谷沸腾!单卡200倍加速,视频进入秒级时代

清华大学TSAIL实验室与生数科技开源视频生成加速框架TurboDiffusion,引发全球AI社区热议。它能在几乎不影响生成质量的前提下,让视频生成速度飙升100 - 200倍,将AI视频带入实时生成时代。

新智元
新闻资讯7

扎克伯格发文正式告别“默认开源”!网友:只剩中国 DeepSeek、通义和 Mistral 还在撑场面

Meta 首席执行官扎克伯格分享“个人超级智能”愿景,透露公司调整 AI 模型发布策略。此前 Meta 强调开源优势,如今态度转变,巨额投入后或暂停开源新模型,计划并行训练开源与闭源模型。

AI前线