手机端推理」共找到 2631 篇相关文章

产品应用8

AI Code要变天了,Meta首个代码世界模型登场!

Meta FAIR推出32B参数的代码世界模型(CWM),旨在探索世界模型如何改变代码生成和推理,code和mode已开源。在SWE - bench验证中表现优,能与更大规模或闭权重的LLM竞争,还介绍了训练、数据集等情况。

PaperAgent
产品应用8

Wan2.5+Midjourney V7,阿里夸克这个新AI鲨疯了!价格还砍一大刀

夸克“造点”AI发布,采用Wan2.5+Midjourney V7双强模型联合。它不仅接入Midjourney V7,还率先接入通义万相Wan2.5,开放7天免费体验,且会员价格减半。功能强大,生图、生视频等操作丝滑,移动还能一句话任意P图。

量子位
产品应用9

支付宝“阿宝”背后的 Agentic 终:从对话到办事,xUI 如何重构 AI 交互

本文整理自蚂蚁集团支付宝AI云交互负责人魏凤笛的大会分享,系统介绍支付宝AI入口产品“阿宝”背后的xUI技术体系,涵盖通信、交互、执行、多Agent协同四大核心方向,分享了大厂移动Agent落地的工程实践与未来规划。

InfoQ
新闻资讯7

OpenAI自研芯片270天光速成功!谷歌TPU大将主导,老黄一夜大客户变对手

OpenAI发布自研推理加速芯片Jalapeño,与博通和Celestica合作打造,专为大模型优化,9个月就流片。操刀者是前谷歌TPU核心成员Richard Ho,计划2026年底部署。此前谷歌、微软等已自研芯片,英伟达客户变对手。

量子位
算法论文8

RAG新SOTA,还在5亿条数据上跑进秒级,只有它了

本文围绕RAG技术展开,指出传统RAG在多跳推理等方面存在局限。介绍了GraphRAG、HippoRAG 2的优缺点,重点阐述Zleap AI的SAG方案,它用超边结构重构数据底座,在多跳问答测试中表现出色,还能在大规模数据下低延迟落地。

机器之心
产品应用8

VLA进化后降维打击!双手拣货,漂移操作,还能批量化秀舞,太空舱直接开上街,被银河通用卷到了

世界机器人大会上,银河通用的人形机器人Galbot在具身智能小卖部营业,背后是自研具身智能大模型。其与英伟达联合首发的机器人应用表现出色,太空舱也在北京首发,适配多场景,具身大模型商用能力获认可。

量子位
算法论文8

只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
推荐文章9

GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率

OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。

AI科技大本营
新闻资讯7

突发!Fable 5.1遭黑客破解,27万字提示词泄露

Fable 5.1和Mythos 5.1发布,Fable 5.1推理成本低32%。但发布几小时后被破解,27万字提示词泄露,曝光了其安全限制、隐私保护等秘密。它工具增加,还破解密码、能完成多种任务,不过也有用户抱怨耗token等问题。

新智元