「超算Colossus 2」共找到 3785 篇相关文章
大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!
Qwen团队等最新研究打破传统认知,揭示‘对齐税’现象。提出置信解码策略,在多架构、评测集上表现出色,能绕过‘对齐税’,提升推理准确率,且工程开销低,为大模型发展提供新思路。
喜报“朝阳区AIGC视听文化产业集群”入选市级中小企业特色集群
近日,朝阳区AIGC视听文化产业集群入选2026年度北京市中小企业特色产业集群。该集群在AIGC细分领域领先,其核心北京AIGC视听产业创新中心已汇聚超100家企业及12所高校,首创郎园负责运营。
从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代
快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。
AI光通信还能火多久?股价暴涨10倍,Lumentum称订单已经排到了5年后
随着AI数据中心建设加速,光通信成AI基础设施增长最快环节。Lumentum作为光通信核心器件龙头,订单排到5年后,股价涨幅超1000%。AI光通信需求旺,但激光器产能紧,英伟达等纷纷布局。
RAG外部检索是多余的,英伟达最新成果颠覆认知
英伟达INTRA论文指出RAG架构中检索器和生成器在不同表示空间工作,存在retriever - generator mismatch问题。INTRA让模型用注意力查询检索自身编码表示,训练量小,在多跳QA上超越多种检索基线。
说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!
作者提前2天拿到Qwen3.7-Max内测,经测试,该版本补齐短板,综合能力强。审美提升明显,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具里。
不用递归自动微分,也能稳定计算高阶 PDE 导数? Mollifier Layers 如何改造 PDE 反问题学习
本文介绍《Mollifier Layers: Enabling Efficient High-Order Derivatives in Inverse PDE Learning》,指出传统PINN递归自动微分计算高阶PDE导数有瓶颈,Mollifier Layers用解析卷积替代,实验显示其在精度、效率上有优势,也有核选择等局限。
蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即可适配新机器人
蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真机后训练工具链,覆盖四个关键环节。模型基于2万小时真实机器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。
英伟达力荐,小团队两个月开源一款「光速级」智能体推理引擎
智能体时代算力需求庞大,LightSeek Foundation 小团队 2 个月打造大模型推理引擎 TokenSpeed,有 TensorRT LLM 性能、vLLM 易用性,受英伟达力荐且已开源,为智能体负载提供近「光速级」推理能力。
马斯克宣布解散xAI,把数据中心整租给了他讨厌的Anthropic
当地时间5月6日,马斯克宣布xAI并入SpaceX更名为SpaceXAI,还将Colossus 1数据中心租给曾被他称“邪恶”的Anthropic。此时距SpaceX IPO路演仅33天,xAI解散或助力提升估值。