「为旌科技」共找到 4991 篇相关文章
2025谷歌研究学者计划名单:吴佳俊、Mamba作者Albert Gu、Tri Dao等获奖
本周四,2025年谷歌研究学者计划获奖名单公布。该计划为鼓励与科研人员合作、推动科技进步而设,申请人需为高校教职人员,获奖者最高可获6万美元奖金。本文列出了部分获奖华人学者信息。
独家 | 华为天才少年楼燚航离职创业,要做 200B 以上的「具身大脑」
前华为“天才少年”楼燚航离职创立引力蓝移,定位构建具身大脑。其采用分层架构,认为具身智能Scaling拐点已至,规划了数据来源和模型参数规模。正与汇川合作,按24个月规划推进,面临产品验证挑战。
ICLR发了Oral又反悔,理由是查到了制裁名单?
一篇被ICLR接受为Oral的论文,因作者在arXiv预印本提及工作部分在被美国制裁的RAIRI机构完成,遭ICLR无视审稿直接拒稿。网友将其与NeurIPS类似事件对比,还对作者是否“刻意隐瞒”有不同看法。
Token 新译名:「智元」
文章讨论Token新译名「智元」,认为其比「词元」更合适。介绍英伟达GTC 2026上黄仁勋强调AI推理时代智元重要性,OpenClaw消耗大量智元引争议,还提及黄仁勋闭门会观点及多位大佬对「智元」译名的认可。
马斯克冲刺机器人量产,果断停产特斯拉豪华车型!2026年资本支出将“非常大”
在最新财报电话会议上,马斯克宣布特斯拉2026年第二季度停产豪华车型Model S和Model X,为擎天柱机器人让出生产线,还将投资20亿美元给xAI,今年资本支出或超200亿美元。此外,Neuralink也有新进展。
DeepSeek V3.2爆火,Agentic性能暴涨40%解密
文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。
KTransformers入选计算机系统顶会、与主流框架合作,趋境&清华让「异构」成为推理新范式
KTransformers由趋境科技与清华团队联合研发,是高性能异构推理框架。其论文入选SOSP 2025,还与SGLang合作。它有算子优化等创新,能让CPU与GPU协同,推动推理架构融合,已成广泛复用的底层框架。
我觉得“Agent”这个词,现在终于有了一个大家都认可的定义了
作者Simon Willison认为现在‘Agent’有了大家认可的定义,即一个AI Agent是为实现目标循环调用工具的大语言模型。还分析了此前难统一定义的情况、‘工具循环实现目标’含义,指出不同人群对‘Agent’理解有偏差。
突发!微软与OpenAI同日开火:语音之战+通用大模型,AI霸权决战打响
OpenAI发布语音大模型时,微软同日推出自研语音模型MAI-Voice-1和通用模型MAI-1-preview。MAI-Voice-1效率高、表达丰富,MAI-1-preview采用MoE架构。微软此举在语音战场布局,也为与OpenAI谈判增加筹码。
通过查看GPU Assembly分析CUDA程序
文章是关于通过分析SASS代码提高内存受限CUDA程序性能的笔记。以向量复制程序为例,对比普通和向量化版本,通过查看SASS代码,解释向量化版本性能更快的原因是加载/存储数据量更大、启动块数更少。