「大数据任务」共找到 7906 篇相关文章
LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析
文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。
CMU朱俊彦等上新LEGOGPT,一句话就能搭乐高,网友:复杂零件行不行?
近日,CMU助理教授朱俊彦团队带来基于文本生成3D乐高的大模型LEGOGPT,输入文本即可快速拼好乐高,生成的乐高还有纹理和颜色。研究人员让机器臂组装模型,结果完美。该模型仍有局限,团队正努力扩展能力。
10岁寒武纪,迎来好日子
常年亏损的寒武纪在2024年四季度和2025年一季度连续单季盈利,2025年一季度营收同比大增4230.22%。其云端产品线贡献大,受益于英伟达芯片出口受限。不过,它在生态和战略上与英伟达有差距,还面临诸多竞争。
太狠了!为了锁死DeepSeek,Anthropic要求加大AI芯片出口管制
全球著名大模型平台Anthropic发布文章,赞同并建议特朗普制定更激进规则限制AI芯片出口,以保持美国在与中国AI竞争中的领先地位,还污蔑中国运输芯片方式,拿DeepSeek举例说明芯片限制影响,并提出三点限制建议 。
突发,Claude刷新物理学世界纪录!单挑基于杨振宁理论9圈难题
本文报道Anthropic的Claude攻克理论物理前沿难题,成功算出平面N=4超杨-米尔斯理论六粒子振幅的九圈结果,打破人类此前保持的八圈纪录,计算成本仅几千美元,展示了大模型在科研领域的突破性能力。
百度百舸演讲:用 Agent 优化 SGLang,从改Kernel修改到端到端验证
本文是百度百舸与SGLang联合Meetup的分享整理,讲解如何让Agent完成从瓶颈定位、Kernel修改到端到端验证的全流程SGLang性能优化,覆盖多类模型场景,公布实测性能提升数据与百度百舸的通信优化效果。
刚刚,Jev全网解禁!1.2亿Token限时免费用
本文报道TypeSafe AI旗下专做结构化决策判断的AI模型Jev全网解禁,开放所有用户直接使用,新用户赠送1.2亿Token额度且输出免费,Jev配合大模型的玩法引发全球开发者热潮,展示了多个实用落地场景。
The Batch: 979 | LLM 清理智能体的“垃圾”
研究人员提出选择性管理智能体记忆之法,小红书Xubin Hao等构建Self - GC。它在送上下文给LLM前,让大语言模型决定内容取舍。测试显示其删历史少且保留必要细节能力强,不过未测其输出质量。
机器人从炫技 Demo 走向上岗,两篇 ICML 顶会论文拆解背后的智能底座
在WRC世界机器人大会上,云蝶科技发布RoboForge系统级具身大脑和WING任务型本体。其科研团队两项成果POLIA与Strat-Reasoner发表于ICML 2026,从视觉证据和他者意图两方面,为理解具身大脑技术提供切口。
AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺
ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。