大数据」共找到 6768 篇相关文章

开源动态8

超越谷歌Banana,字节联合香港中文学等高校开源最强图像编辑生成系统DreamOmni2

香港多高校与字节跳动联合研发的DreamOmni2系统,实现图像编辑与生成领域SOTA。它用三步造出高质量数据,提出索引编码等方案,联合训练模型,实际效果超越部分商业模型,为AI创作带来新可能。

AIGC开放社区
算法论文7

斯坦福:优化器「诸神之战」?AdamW 凭「稳定」胜出

斯坦福学 Percy Liang 团队研究指出,虽有不少声称能显著加速的优化器替代方案,AdamW 仍为预训练稳健首选,但矩阵型方法在特定数据–模型比例下优势明显。研究还揭示了现有研究的方法论缺陷。

机器之心
新闻资讯7

神Karpathy炮轰复杂UI应用没有未来,Adobe首当其冲,网友:不提供文本交互,就是在阻挡AI浪潮

神Karpathy预言只有复杂UI界面、不提供文本交互的应用将被淘汰,还点名Adobe、CAD。他言论引发讨论,支持者强调后端接口,反对者认为专业软件有其价值。此外,他还批判模型编程‘重生成轻判别’。

量子位
算法论文8

「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!

本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。

新智元
推荐文章7

企业官网GEO优化实操:如何让AI主动推荐你的官网?

本文作者白杨SEO从2011年入行SEO,2024年起研究AI搜索优化。他指出当下AI平台引用来源变化,企业官网成重要来源。作者从网站代码、站内内容、站外推广三方面,教家做好官网GEO优化,让AI推荐官网。

孔生SEO
开源动态7

GLM-5登顶开源模型No.1!智力指数首破50关,打平Opus 4.5

在Artificial Analysis评测中,GLM - 5成开源权重模型智力排名第一,是首个智力指数破50的开源模型,除代码能力外各方面表现出色。它集成DeepSeek稀疏注意力,参数规模,擅长“搞钱”任务,幻觉率低且输出精简。

AI寒武纪
开源动态8

超越DeepSeek-R1,数学形式化准确率飙升至84% | 字节&南开源

字节跳动Seed团队与南京学联合发布CriticLean框架,将数学自然语言到Lean 4代码的形式化准确率从38%提升至84%。该框架创新性地将评估模型置于核心,解决语义对齐等问题,还构建了相关基准测试和数据集。

量子位
新闻资讯8

见证历史!DeepSeek跃居全球第二AI实验室,R1登顶开源王座,R2全网催更

昨晚,DeepSeek官宣R1完成小版本升级,开启「深度思考」功能可体验。其R1-0528性能媲美o3和Gemini 2.5 Pro,还微调了8B模型。DeepSeek成全球第二AI实验室和开源王者,网友催更R2。

新智元
推荐文章7

对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限

AICon会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。

InfoQ
开源动态8

华人学生立功!新王Mamba-3直击Transformer死穴,推理效率碾压7倍

新一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用新设计哲学,推理优先,有三核心技术,还能与自注意力层混合提升检索能力。

新智元