「高管团队」共找到 5021 篇相关文章
清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理能力
清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。
腾讯助力Deepseek完善DeepEP,RoCE提升100%,InfiniBand提升30%
Deepseek团队合并腾讯提交的代码完善DeepEP,称有巨大速度提升,RoCE提升100%,InfiniBand提升30%。DeepEP是为混合专家模型和专家并行设计的通信库,有多项创新特性,适合现代AI应用。
DeepSeek开源的文件系统,是如何提升大模型效率的?
2月28日,DeepSeek开源高性能分布式文件系统3FS以解决人工智能训练和推理挑战。介绍了分布式文件系统优势,深入解读3FS的组件、CRAQ协议等,还探讨其与其他系统差异及性能相关问题。
本地版Jev 1G内存就能跑!四舍五入等于不要钱啊
Jev爆火一周后,开发者推出适配Apple MLX框架的Laya-MLX,是开源决策模型Laya的原生本地版,最低仅需不到700M内存即可在Mac运行,速度快准确率高,适合高频短决策任务。
60天融资数千万,何泳澔出任CTO!这家黑马冲刺「最后一公里」
本文报道具身智能赛道初创虚时科技,60天内累计完成数千万元融资,前地瓜机器人具身智能算法负责人何泳澔出任CTO。公司押注仿真训练解决机器人落地数据瓶颈,推出全链路闭环仿真训练系统,已获得工业场景订单。
AI Coding 的下一步不是写得更快,而是可验收:蚂蚁数科 Harness 工程实践
蚂蚁数字科技资深技术专家魏长征在AICon大会分享AI Coding实践。指出当前产能提升快,但验证能力可能跟不上,容易引发质量风险。介绍了Harness工程思路及在新项目和存量项目中的应用,还提及AI协作的未来挑战。
NovaSilicon发表新论文:造芯的瓶颈不在工具,而在组织
NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA方法遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。
Ilya新模型要来了?投资人爆料:今年最重要的发布!
a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的新模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。
从海外断供到全国产闭环,安世中国做对了什么?
安世中国在2025年9月30日遭海外断供晶圆后,于次年8月23日新品全球发布会公开亮相。其从组织、供应链、研发、渠道四方面重构,取得12英寸量产等成果,还给出未来路线图,有重大产业意义。
David Baker、宋乐等联手创办GenBio AI: 虚拟细胞只是开始,数字有机体才是终局
GenBio AI 在《Nature Medicine》发文,提出构建能模拟生命运行的“数字有机体”(AIDO),还阐述构建路线及应用设想。该公司团队强大,目前已进入 AIDO 构建第二阶段,但面临评估、可解释性等难题。