有限算力」共找到 899 篇相关文章

新闻资讯8

英伟达铁幕之后,谷歌AI芯片已成气候

英伟达在AI领域风头正劲,谷歌却在幕后打造AI基建帝国。谷歌CEO官宣第七代TPU Ironwood商用,算力惊人。谷歌TPU历经十年进化,已形成成熟产品组合,且构建了全栈AI生态,未来发展势能深厚。

新智元
算法论文7

中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力

大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。

机器之心
新闻资讯7

干家务一小时挣1000元,具身智能时代人类新岗位

机器人是AI热门领域,但面临数据荒。训练数据分真实与合成两类,前者质量高但成本高、规模有限,后者成本低。数据标注服务商高价回收做家务等视频作训练素材,各方努力下优质数据仍短缺。

量子位
新闻资讯7

陶哲轩:用了GPT-5 Pro后,小尺度、宏观尺度很赞,中尺度有点垮

著名数学家陶哲轩用ChatGPT - 5 Pro研究曲率有界的球面问题,记录AI在不同层面的表现。小尺度和宏观尺度AI有用,中尺度帮助有限。虽问题未解决,但他学到新知识,也意识到与AI协作要谨慎。

机器之心
新闻资讯7

Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention

这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。

Founder Park
算法论文8

大模型再爆弱点!旧记忆忘不掉,新记忆分不出,准确率暴降 | ICML'25

弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。

新智元
算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在多模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
新闻资讯7

如果海外EDA断供,国产EDA公司能支棱起来吗

文章分析了EDA行业及国产EDA覆盖情况。全球三大家EDA公司处于垄断地位,EDA市场规模小,容纳公司有限。国产EDA公司数量多但有差距,部分工具可用但仍需打磨,国产EDA发展道路艰难但要坚持。

芯师爷
新闻资讯7

AI狂飙100天,中国力量突起!顶流视频号10分钟看尽全球最强杀招

2025年开年,全球AI版图重绘,从中国DeepSeek开源风暴到OpenAI闭源反击,双方在算力、模型等层面激烈碰撞。各月双方均有新动作,4月AI迈入全民普及,新智元联合视频号推出活动助掌握科技风向。

新智元
算法论文8

ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE

长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。

机器之心