能源瓶颈」共找到 652 篇相关文章

新闻资讯8

黄仁勋年初对话:2025 的 AI 如何塑造产业的「五层蛋糕」?

NVIDIA 创始人黄仁勋接受专访,反驳 AI 致失业说法,阐述 AI 技术栈「五层蛋糕」模型,强调开源重要性,批评「上帝 AI」与末日论,还谈到 AI 成本下降、能源需求及「AI 泡沫」等议题。

机器之心
新闻资讯7

谷歌为 AI 算力拼了!砸下 47.5 亿美元收购 Intersect Power,连对方债务都接盘了

谷歌母公司 Alphabet 以 47.5 亿美元现金收购数据中心及清洁能源开发商 Intersect Power,还承接其债务。收购助力扩大发电装机规模,保障数据中心电力供应,交易预计明年上半年完成。

AI前线
开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
算法论文8

解决Agent幻觉:HaluMem精准定位记忆系统的“说谎”环节!

近年来,LLM和Agent在记忆管理上存在挑战,现有评估方法无法定位幻觉来源。论文提出HaluMem评估基准,通过三大任务和两个数据集揭示记忆系统幻觉行为,为开发可靠记忆机制提供指导。

深度学习自然语言处理
开源动态7

被DeepSeek带火的OCR,最新8个开源模型盘点~

DeepSeek-OCR发布让OCR大热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。

PaperAgent
开源动态8

DeepSeek开源的不仅仅是个新OCR模型。。。

DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。

AI工程化
新闻资讯8

Sam Altman最新博文!温和的奇点

OpenAI CEO Sam Altman在新博客《The Gentle Singularity》中探讨AI进步远超想象时世界的变化,提及AI将在多方面做贡献,还给出未来几年AI发展预测,指出要解决安全和对齐问题。

AI工程化
产品应用8

训练MoE足足提速70%!华为只用了3招

Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。

量子位
产品应用8

1000+页PDF解析速度暴涨3倍,MinerU模式不香了

百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。

CourseAI
算法论文8

Speech LLM 的下一个突破口:你的语音大模型可以是个「带韵律的文本模型」

语音大模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文大学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。

机器之心