「新能安」共找到 7818 篇相关文章
AI正在疯狂吞噬一切!数据中心价值暴涨,但这场狂欢能持续多久?
文章指出AI数据中心投资使美国GDP增长显著,市场规模将大幅增长。科技巨头疯狂砸钱,投资集中在北弗吉尼亚。专家观点分裂,作者认为需求真实但短期有泡沫,投资可能推动进步,也可能重蹈覆辙。
腾讯Kuikly框架进一步开源,新增支持Web,开启一码五端新体验!
腾讯Kuikly框架进一步开源,新增Web版支持H5和微信小程序。该框架基于Kotlin Multiplatform,已被20+业务深度使用。与主流框架对比,它在产物大小、加载速度等方面优势明显,还将持续优化和拓展。
大模型训练新突破!“不对称”训练让AI学会自我反思,推理零开销
字节团队提出全新语言模型训练方法PCL,首次打破训练与推理对称约束,实现‘训练-推理不对称’。在训练时让模型反思评估结果,推理时仅输出答案,零额外开销,显著提升模型能力。
从Debugger到Developer : 低代码时代新基准NoCode-bench,SWE-Bench作者力荐
浙江大学牵头联合多机构推出全新评估基准NoCode - bench,直面自然语言驱动功能添加任务,发现当前最佳LLM成功率仅两成。它构建严谨,任务挑战大,指明AI软件开发改进方向,且已开源。
AI 基础知识从 0.5 到 0.6—— Transformer 架构为何能统治AI领域?
文章围绕Transformer架构展开,先介绍其诞生背景,对比CNN、RNN等模型,阐述其在多领域的核心地位。接着剖析工作流程、实现原理,包括QKV机制、多头注意力等。最后列举T5、GPT等常见架构模型,并提及通义千问3与MCP协议。
港科大&北京人形提出LOVON:足式机器人开放世界全域目标追踪新范式!
港科大广州联合北京人形创新中心推出LOVON框架,融合大语言模型、开放词汇视觉检测和语言 - 运动映射模型,解决足式机器人开放世界全域目标追踪难题,有抗干扰视觉处理等优势,性能超传统方法。
ICML 2025 | 大模型能在信息不完备的情况下问出正确的问题吗?
当前大语言模型推理研究多聚焦被动推理,主动推理研究少,制约其在现实场景应用。为此提出 AR - Bench 基准评估大模型主动推理能力,实验显示大模型主动推理能力严重不足,并指出后续拓展方向。
揭秘白宫「AI甄嬛传」!奥特曼篡位马斯克,美国迎来AI「新教皇」
从‘冷板凳’到‘白宫座上宾’,奥特曼用不到一年完成华丽转身,替下马斯克掌控美国AI舵盘。他与特朗普从立场相左到同台亮相,OpenAI调整策略迎合特朗普,其政策目标也逐步落实。
开源Agent新标杆:通义WebSailor多榜夺魁,挑战OpenAI高难度Agent基准BrowseComp
信息爆炸时代,传统搜索引擎难满足需求,开源Web Agent在极端复杂任务表现不佳。阿里巴巴通义实验室推出WebSailor,通过创新数据构造和训练方法,在BrowseComp等挑战上取得突破,缩小与顶级封闭系统差距。
华为CloudMatrix重磅论文披露AI数据中心新范式,推理效率超NV H100
华为发布60页重磅论文,提出下一代AI数据中心架构Huawei CloudMatrix及产品CloudMatrix384。它架构设计独特,性能高效准确灵活,打破算力、延迟和成本“不可能三角”,重新定义AI基础设施。