算力投入」共找到 978 篇相关文章

算法论文8

NeurIPS 2025 Spotlight | FSDrive统一VLA和世界模型,推动自动驾驶迈向视觉推理

面向自动驾驶的多模态大模型存在问题,FSDrive提出“时空视觉CoT”,让模型“以图思考”,联合未来场景与感知结果进行可视化推理。该方法在不改动原有MLLM架构前提下激活图像生成能力,实验表现出色。

机器之心
算法论文8

英伟达的AI已经开始接管整个项目了?SATLUTION自主进化代码库登顶SAT竞赛

NVIDIA Research提出SATLUTION框架,将LLM代码进化能力扩展到完整代码库规模,能处理复杂项目。它协调LLM智能体对SAT求解器代码库迭代优化,在SAT竞赛中超越人类冠军,成本低且效率高。

机器之心
新闻资讯7

Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘

人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。

机器之心
算法论文8

唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力

大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。

机器之心
新闻资讯7

DeepSeek一句话让国产芯片集体暴涨!背后的UE8M0 FP8到底是个啥

DeepSeek V3.1发布后,官方留言提及新架构和下一代国产芯片,引发AI圈轰动,国产芯片企业股价上涨。文章介绍了UE8M0 FP8概念,分析其适配国产芯片原因,还猜测适配的芯片厂商,指出代表国产AI走向软硬协同。

量子位
开源动态8

谷歌最新「0.27B」Gemma 3开源!身板小却猛如虎,开发者直呼救命稻草

大模型时代开发者算力焦虑严重,谷歌Gemma 3系列另辟蹊径。新成员Gemma 3 270M参数规模小但性能强,如在IFEval测试表现突出,有小体积强架构、省电等亮点,适用于多场景。

新智元
新闻资讯7

传言:华为版 DeepSeek R2 本月发布

据 Huawei Central 报道,DeepSeek R2 可能本月 15 至 30 日发布,运行在华为 Ascend 910B 集群,硬件利用率 82%,算力 512 PetaFLOPS FP16,效率达 A100 的 91%,将与 ChatGPT 5 竞争,但消息未证实。

AGI Hunt
新闻资讯7

砺算科技GPU背后的故事

文章讲述砺算科技GPU背后故事,包括其团队核心成员来源,经历的资金、欠薪等问题,还提及S3人员流动衍生出的其他GPU企业。分析砺算科技团队稀缺性、融资短板等情况,对比不同GPU发展路线。

芯师爷
新闻资讯8

大模型竞赛转向:决胜关键为何是“后训练”?|甲子光年

大模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。

甲子光年
新闻资讯7

OpenAI 宣布启动“全国人工智能教育研究院”:美国K-12教育全面AI化

OpenAI宣布与美国教师联合会合作,启动‘全国人工智能教育研究院’,这是为期五年的计划,目标是为全美40万K12教育工作者提供AI培训和支持。OpenAI五年内投入1000万美元,计划在多地建中心。

AI寒武纪