「Dojo超算」共找到 2177 篇相关文章
Karpathy 教它的 nanochat 数单词里有几个“r”
Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。
NeurIPS 25 | 中大&UC Merced等开源RAPID Hand,重新定义多指灵巧手数据采集
来自多机构研究者联合提出全新开源高自由度灵巧手平台 RAPID Hand。它能解决硬件瓶颈问题,实现稳定、高质量数据采集。其软硬协同优化,在操作表现与稳定性上优于现有方法,还具备低成本等优势。
30.9K Star牛啊!!再见了PD,不越狱也能装,支持几十种系统,苹果全设备通用!
在苹果生态运行其他系统,Parallels Desktop 收费且移动设备难装。开源工具 UTM 免费,基于 QEMU 构建,支持多架构和系统,操作界面简洁,外围设备支持强,苹果全设备通用。
LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收
LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。
空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer
香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。
腾讯开源WMT2025冠军大模型:拿下30个第一,同类最佳
昨晚腾讯开源WMT2025冠军翻译大模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。
逼近万亿市值,被称为“代工厂” 的工业富联凭什么?
2025年4月以来工业富联股价上涨,8月19日总市值达9713亿逼近万亿。上半年营收、净利润增速超35%,云计算业务增长显著。但它毛利率低、研发投入不足,转型面临挑战。
教育工作者如何使用AI?Anthropic分析了7.4万份对话后,发现了这些
Anthropic分析7.4万份匿名对话,揭示高校教师用Claude的情况。教师用AI场景多样,如课程开发、学术研究等。使用方式分协作增强与完全委托,AI评分有争议,研究也存在局限。
Meta宣布AI研究架构调整,成立TBD Lab,取消AGI Foundations团队,强化超级智能战略
Meta进行AI研究架构大重组,将业务分为研究、训练、产品和基础设施四个团队。成立TBD Lab探索新方向,如构建‘omni’模型;FAIR成创新引擎;解散AGI Foundations团队。旨在强化超级智能战略。
告别单Agent,AI Agent进入团战时代!
上周CAMEL - AI开源Eigent,号称“全球首个桌面端多智能体生产力团队”,后脚Manus上线功能相似的“Wide Research”。本文分享Eigent内核,介绍其特色、与Manus对比,还深挖技术架构、MCP及容错机制。