「时间-深度对偶性」共找到 1090 篇相关文章
弯道超车?国产具身,千小时人类数据激发智能涌现
近日,深度机智用人类学习范式在国际 Benchmark 上击败巨头,成果两会首日被央视报道。其全新架构源于一年多积累。英伟达也有人类学习尝试。深度机智构建全栈技术矩阵,成果显著,3 月底成果将开源。
从一行代码发现DeepSeek的秘密:Model1到底是什么?
在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。
JCP | 南科大邹欣桐、王建春等:神经算子在三维湍流预测中的不确定度和稳定性分析
本文以三维各向同性湍流为例,提出面向神经算子的可信度评估框架,考察预测误差不确定度、长时迭代稳定性及流场时间相关性对模型可靠性的影响。结果显示,物理约束和合理时间步长可提升模型稳定性与可靠性。
终结数据荒!智源开源首个Deep Research数据合成框架InfoSeek
在大模型深度研究中,高质量数据是短板。近日,智源研究院发布首个面向深度研究的开源数据集InfoSeek,提出「扩散 - 回溯」数据合成方法,用3B模型在基准测试中接近商业模型表现,且数据集可扩容。
AI大模型开发核心技术栈:从框架到部署的全景解析
本文为开发者提供2025年AI大模型开发核心技术栈图谱,解析四大核心支柱技术。基础开发框架含深度学习与AI Agent框架;模型训练与微调有分布式训练、参数高效微调;推理优化含关键技术与主流框架;AI编程辅助工具分主流形态且有发展趋势。
时间会证明光的
市场曾质疑AI资本开支高增长的持续性,如今随着头部模型公司ARR非线性爆发式增长,AI商业正向循环打通。在AI硬件产业链中,光互联是国内厂商全球参与度最高、份额最稳固的环节,正迎来最好时代。
扩散语言模型深度思考
作者探讨扩散语言模型(dllm),认为其建模方式或冲击AR。团队在AAAI报告介绍多项工作,还整理当前diffusion问题及观点,如推理架构、词表、优化范式等,并附项目网站和agent demo。
深度解读黄仁勋的万亿美元蓝图
2026年3月16日,黄仁勋在GTC演讲中称AI计算需求至少达1万亿美元,实际或更高。他回顾AI三次拐点,介绍推理时代超级计算机Vera Rubin,还发布OpenClaw等软件,成立开源模型联盟,展示各行业应用,强调共封装光学重要性。
SGLang Hierarchical Sparse Attention 技术深度解析
阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。
刚刚,宇树科技IPO时间定了!
宇树科技确定2025年10 - 12月提交IPO申报文件,今年已完成股份制改革、C轮融资等。公司连续五年盈利,营收破10亿。其产品频破圈,创始人王兴兴以电机直驱另辟蹊径,推动企业发展。