「AI算力大会」共找到 12262 篇相关文章

算法论文8

Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态大模型

中国科学院计算技术研究所团队提出文本-视觉-语音多模态大模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。

机器之心
新闻资讯7

Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude

Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为大模型要规模化,断言大模型训练进入第三阶段。

量子位
推荐文章8

我用 AI 翻译的三个阶段:提示词时代 → 推理模型时代 → Agent 时代

作者分享近 2 年 AI 翻译经验,将其分为提示词、推理模型、Agent 三个时代,介绍 Agent 翻译与提示词翻译区别,还阐述 Skill 创建迭代、三种翻译模式由来等,给出解决一致性问题等方法。

宝玉AI
产品应用7

港股新贵押注物理AI,乐动机器人打造万亿市场空间的核心基础设施

物理AI时代,机器人需「读懂」物理环境,环境感知能力成竞争焦点。乐动机器人过去十年围绕此布局,有空间感知技术先发优势,其自研模型与架构构建数据飞轮,有望完成向感知基础设施平台的身份重塑。

量子位
算法论文8

知识图谱推理新sota,兼顾性能+效率!中科大新作 | NeurIPS'25

知识图谱推理应用广泛,但现有方法面临推理效率低、表达能力不足等挑战。中科大团队提出DuetGraph,采用双阶段粗到细推理框架与双通路全局 - 局部特征融合模型,平衡推理精度与效率,缓解过平滑问题。

新智元
产品应用7

模力工场 028 周 AI 应用榜:AI “身体”觉醒,从工业前线到情感陪伴

模力工场第028周AI应用榜揭晓,上榜应用多来自美国CES展及阿里云通义智能硬件展。AI从虚拟走向物理世界,工业领域机器人成“智能员工”,消费领域有情感陪伴型产品,OiiOii降低动画创作门槛。

AI前线
新闻资讯7

“像把大象塞进冰箱一样困难”,端侧大模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧大模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
算法论文7

大模型在具身推理上「翻车」了?4496 道题全面揭示短板

美国东北大学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态大模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。

机器之心
算法论文8

大模型训练的不稳定性有望彻底解决,MIT新研究用谱正则化替代层归一化

MIT团队创造Lipschitz Transformer,用谱正则化替代层归一化,认为或解决训练不稳定根本原因。他们对比多种方法权衡,发现Muon + 奇异值裁剪推动权衡边界,且工作完全开源。

AGI Hunt
算法论文8

告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜

DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态大模型集成,提升推理能力,实验效果显著。

机器之心