手机端推理」共找到 2610 篇相关文章

产品应用8

AI × 老旧系统:Vibe Coding 构建 AI 迁移工具,实现 10x 智能迁移

文章指出老旧系统现代化复杂且需大量人工,AI 编程工具和 Vibe Coding 带来新可能。介绍 6R 策略、绞杀模式等迁移方法,还阐述 AI 在系统分析评估、代码转换等方面的应用,最终目标是打造闭环 AI 迁移 Agent。

phodal
算法论文8

32B逆袭GPT-5.2:首个GPU编程智能体框架StitchCUDA问世

现有LLM自动化CUDA方法难处理GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。

机器之心
开源动态8

「豆包手机」被智谱开源了,AutoGLM 实测

豆包手机发布后火爆,智谱开源AutoGLM,能让安卓手机变「AI手机」。作者实测,它能完成点外卖、比价等任务,设计贴心尊重隐私。适合开发者、效率爱好者等,还会推动Phone Agent生态发展。

特工宇宙
开源动态8

微软重磅开源!22K星的 VibeVoice 再添新成员,60分钟音频 ASR 统一输出!

现在的 ASR 模型处理长音频存在断章取义、说话人错乱等问题。微软开源 VibeVoice-ASR,可一次性处理 60 分钟音频,实现“三位一体”输出,补齐 VibeVoice 生态,还介绍了特点、架构、使用方法与应用场景。

开源星探
新闻资讯7

机器人全程自主收拾客厅!390亿美元估值机器人新技能,英伟达持续加注

估值390亿美元、英伟达持续看好的Figure机器人有新进展,能完全自主、全流程整理客厅。背后是其自主研发的具身大脑Helix 02系统,仅补充新数据就能掌握全新任务。

量子位
算法论文8

清华新框架让大模型学会「精读略读」!实现12倍加速,基准评分翻倍

清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍加速,为长上下文LLM部署提供新范式。

量子位
产品应用7

产品经理也能“开发”需求?淘宝信息流从需求到上线的AI实践

淘宝推荐信息流业务被“需求多、技术栈杂、协作慢”困扰,上线周期长。WaterFlow这一AI驱动的开发实践,让部分需求两天内上线,产品经理也能参与。文章揭秘其落地及协作模式改变,还展示了实践效果。

阿里云开发者
算法论文7

The Batch: 863 |推理提高了碳排放

新研究量化推理模型时代提供更优答案的环境成本,研究人员估算14个开源权重的大模型碳排放,发现推理与排放存在权衡关系,还指出战略性部署可降低排放。

DeeplearningAI
产品应用7

10个Agent一键组队:并行智能体协作,交付从24h缩减到4h!

过去写代码靠程序员手动输入,即便有Copilot等工具,仍需人主导。并行代理出现后,程序员可调用多个AI并行工作,将交付时间从24h缩减到4h,思维方式也需转变,对工程师能力要求也有变化。

新智元
新闻资讯7

新版Claude曝光:“极限推理”成最大亮点

O家刚免费上线GPT - 4.1,A家新版Claude Sonnet和Claude Opus被曝即将发布,亮点是“极限推理”,能在推理和工具使用间建立动态循环,更智能处理问题,预计未来几周发布,虽有网友质疑,但也有实测证据。

量子位