「超节点计算」共找到 2730 篇相关文章
苹果新作:内化视觉思考,推理提速 5 倍
Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。
剧情反转!马斯克牵手 Dario,Anthropic 与 SpaceX 罕见合作
Anthropic官宣与马斯克的SpaceX合作,将使用其超算集群全部算力。因Claude火爆致宕机,Anthropic急需算力。其估值疯涨,而SpaceX闲置算力出租也符合商业逻辑,马斯克还对Anthropic团队表示认可。
这脑洞神了!两AI「互喷」,竟治好祖传科研软件95%老毛病?
科学计算领域开源工具多,但大多难以直接运行,制约AI4S与Agentic Science发展。深势科技推出Deploy - Master,以执行为中心,经搜索和构建,将约50万个仓库筛选收敛,构建成功率达95%以上。
AGI只是硅谷的幻想?!AI科学家盛赞中国,并从物理学角度宣告我们永远造不出AGI
AI科学家Tim Dettmers在博客文章中指出,计算须遵循物理定律,线性进步要指数级资源,硬件升级红利已尽。他认为美国追求AGI和超级智能不切实际,中国重应用普及更务实,AGI难以实现。
谷歌开源新Deep Research范式,教Agent学会真正的思考。
周末谷歌发博客讲Deep Research,它重新定义一些Agent常见范式。现在多数Agent模式缺全局观,谷歌让AI先打草稿再迭代修正。新框架含技巧,在多任务上超OpenAI,已可试用。
马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high
新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。
SmolVLA: 让机器人更懂 “看听说做” 的轻量化解决方案
文章介绍轻量级开源视觉 - 语言 - 动作 (VLA) 模型 SmolVLA,专为机器人领域设计,可在消费级硬件运行。它用公开数据集训练,架构经优化,还引入异步推理堆栈,性能超部分大模型,降低研究门槛。
Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o
Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。
让视觉语言模型像o3一样动手搜索、写代码!Visual ARFT实现多模态智能体能力
上海交大等团队推出多模态智能体训练方法 Visual-ARFT,让视觉语言模型有「工具智能体」能力,还开源项目。它能自动调用工具、拆解任务,团队构建 MAT-Bench 评测,其在多任务超 GPT-4o。
Nature子刊 Scientific Data | 九家单位联合打造!AeroFlowData
现有湍流数据库多聚焦中低雷诺数基础湍流问题,难应对复杂工程高雷诺数湍流挑战。西北工业大学联合八家机构建全球共享的高雷诺数湍流数据库AeroFlowData,结合多技术获取数据,收录近40类模型、超500种工况,数据近100TB。