「大模型适配」共找到 9347 篇相关文章
慕了!内存芯片巨头年终奖人均64万;32岁程序员猝死背后公司被扒,曾给39万“封口费”;马斯克曝星舰成本将降99%,商业航天受捧|AI周报
这是一篇AI周报,涵盖多领域热点。如SK海力士发高额年终奖;月之暗面张予彤称Kimi用少量资源开发领先模型;马斯克透露星舰目标、人形机器人计划等;多家公司有新动态,如阿里推AIGC应用、百川发布医疗大模型等。
EAAI | 西工大夏明坤,张伟伟等:分层无量纲学习:一种物理和数据混合驱动的无量纲关联参数提取方法
在流体力学研究中,高维数据冗余增加模型分析复杂度。本文提出分层无量纲学习方法(Hi - π),通过物理、压缩、映射三层架构自动提取关键无量纲参数组合,在多个算例中表现良好,为参数降维与知识发现提供新思路。
10万引普林斯顿刘壮最新访谈:架构没那么重要,数据才是王道
普林斯顿大学助理教授刘壮在访谈中指出,架构没那么重要,数据、规模和记忆才是决定AI成败的关键。他认为ConvNet和Transformer性能差异源于训练细节;当前数据集远不够多样;大语言模型有语言空间的世界模型,但视觉空间的还缺失;记忆是瓶颈,智能体只是权宜之计;AI目前还替代不了研究生。
R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式
复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三大瓶颈,训练后模型性能双重提升。
MCP 已死?不,它正在进化:三个关键变化
本文针对网传“MCP已死”的说法,解读最新版MCP模型上下文协议的三大核心变化,对比MCP Tasks与A2A的区别,给出选型建议,帮助开发者适配企业级Agent场景需求。
想让机器人春晚包饺子?阿里达摩院:别急,先把「大脑」优化一下
阿里达摩院推出 RynnBrain 模型,从底层出发将时空记忆和物理空间推理训进模型,在 16 项具身 Benchmark 上达 SOTA。还开源 7 个模型,解决通用大模型在物理世界的局限,在多项任务表现出色。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源
面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。
开源共建重塑推理 Infra:从架构创新到生态协同,Mooncake的破局之路
大模型推理落地面临成本、吞吐、长上下文“三角困境”。开源项目Mooncake以“计算存储解耦”为核心,通过PD分离等技术提供底层支撑。直播邀请专家从多视角拆解其技术逻辑、开源价值与企业实践。
英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载
本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。