「大数据任务」共找到 7898 篇相关文章
刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板
DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。
Opus5.5 正在吃掉视频!分镜、动画、音效、配乐,它全做了
本文作者实测Claude Opus5.5的视频制作能力,除人工配音外,分镜、动画、音效、配乐全靠代码完成,对比GPT-6 Astra展示各环节提升,验证大模型全流程做视频的可能性。
来吧,往死理卷,9.8K Star TypeWords~~~
本文推荐Star量9.8K的开源背词项目TypeWords,针对「眼熟单词写不出」的痛点,设计了无提示输出的练习闭环,面向技术人给出使用指南,同时说明其本地存储特性与同步限制。
SGLang 的 DeepSeek-V4.1 Flash Day 0 优化实录:4×B300 上 BS=1 达到 764 tokens/s
本文是SGLang团队的DeepSeek-V4.1 Flash Day 0优化实录,详解了架构适配、KV cache压缩、kernel优化到DSpark适配全流程,公开4×B300 GPU实测吞吐数据,附复现代码与步骤
每周免费送1亿Token!扎克伯格押注王牌产品Muse:AI会24小时替你赚钱,我只负责抽成
本文整理科技记者对扎克伯格的播客访谈,扎克伯格公开反对AI技术被少数机构垄断,介绍了Meta全新推出的个人AI产品Muse的产品设计、商业模式与研发思路。
The Batch: 981 | Ox Alpha 被揭晓为 GLM-5.3-Flash
本文是DeeplearningAI The Batch专栏的AI行业资讯,揭秘此前匿名上线爆火的Ox Alpha模型,公开其为Z.ai推出的GLM-5.3-Flash,详细介绍该模型的架构、性能、定价与授权信息。
首批GPT-6内测结果好离谱啊。。。
GPT - 6使用资格分批开放,内测玩家抢先体验。其在3D生成、游戏开发、网页制作等多领域表现出色,如15分钟做出Mac应用,空间推理达世界级水平,但运行时Token消耗大。
T-RO综述重构Foundation Model时代机器人操作知识版图
近日,论文《Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives》被IEEE Transactions on Robotics接收,它以High - Level Planning和Low - Level Action Modeling为主线,梳理Foundation Model时代机器人操作发展,分析了现存问题及关键缺口。
1GW算力中心耗资600亿美元?黄仁勋G20现场布道“AI经济学”
美国当地时间9月2日,英伟达CEO黄仁勋在G20创新部长级会议阐述‘算力经济学’。他称建1GW规模AI基建约需500 - 600亿美元,算力成国家级核心生产资料,全球到2030年AI基建或达100GW。
给Agent加上知识图谱,开源版Palantir
Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片化企业数据变成结构化、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。