DiT4DiT模型」共找到 8316 篇相关文章

产品应用8

逆天! Claude Opus几小时攻破C++大神4年死磕Bug

Reddit上有30多年C++开发经验的大神ShelZuuz,被一个困扰四年的Bug折磨,投入约200小时未解决。用Claude Opus几小时就找到症结,而此前GPT - 4.1等模型都失败。大神认为AI在编写新代码上像初级开发者。

AI寒武纪
算法论文8

无需训练,直接「算出」最强AI!理想汽车发现端侧Scaling Law

理想汽车基座模型MindVLA团队与国创决策智能技术研究所联合发布论文,提出面向端侧大语言模型的「硬件协同设计扩展定律」,解决大模型部署在端侧设备的难题,实现软硬协同设计,提升模型性能和研发效率。

新智元
新闻资讯7

小扎的残酷算术题:砸6000亿搞AI,裁1.6万人省钱

路透社爆料Meta计划裁员20%约1.6万人,这或为其自2022年底以来最大规模裁员。与此同时,Meta在AI投入巨大,如6000亿美元建数据中心等,但模型表现不佳,如Llama 4反响平平、Avocado推迟发布。

新智元
算法论文7

Auto Research最后一块拼图,Frontier-Eng Bench登场,在工程闭环里死磕最优

Einsia AI旗下Navers Lab论文Frontier - Eng推出新评测范式Generative Optimization,搭硬核评测系统,覆盖47个横跨5大工程方向的任务。评测多种模型,结果显示gpt 5.4最稳健,但距资深工程师水平尚远。

机器之心
算法论文8

超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26

大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。

新智元
新闻资讯7

韩松贾扬清之后,又一家清华系AI公司卖给英伟达,黄仁勋亲自招募95后联创

继韩松、贾扬清后,又一家清华系AI公司Nexusflow被英伟达收购。黄仁勋招募其联合创始人,公司成果亮眼,如开源模型表现超GPT - 4等,这或与生态联系有关,收购也是英伟达活跃布局的一环。

量子位
开源动态8

DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍

DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练量大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。

新智元
新闻资讯8

全球首个IMO金牌AI诞生!谷歌Gemini碾碎奥数神话,拿下35分震惊裁判

谷歌DeepMind官宣Gemini Deep Think在IMO获官方认证金牌,4.5小时解5题得35分。它用纯英语解题,结合并行思考与强化学习训练。谷歌后续将向部分测试者及订阅者推出模型,还公开了解题过程。

新智元
开源动态8

告别“对讲机”时代:面壁智能给 AI 装上了“神经末梢”

2026 年初,OpenClaw 等开源项目让 Agent 概念爆火,但存在延迟、隐私等问题。面壁智能发布 9B 小模型 MiniCPM - o 4.5 和硬件开发板松果派,解决 AI 本地运行痛点,推动其从云端到端侧进化。

AI科技大本营
产品应用8

100%纯血国产AI反超Suno!一个下午做出百万预算主题曲

流媒体平台Deezer数据显示,AI歌曲产能虽高但播放率低,尤其中文歌问题突出。音潮团队从底层重构音潮大模型V4.0,实现算力国产化,产品矩阵四线齐头并进,走出一条有别于Suno的发展路线。

新智元