稳定性提升」共找到 3008 篇相关文章

算法论文8

视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL

数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。

PaperAgent
产品应用8

训练MoE足足提速70%!华为只用了3招

Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。

量子位
算法论文7

SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法

高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。

力学与人工智能
开源动态8

85倍速度碾压:苹果开源FastVLM,能在iphone直接运行的视觉语言模型

苹果开源能在 iPhone 上运行的视觉语言模型 FastVLM,代码仓库含 iOS/macOS 演示应用。它速度快,首个 token 输出速度较同类模型提升 85 倍,还兼容主流 LLM,适合边缘设备等场景。

机器之心
新闻资讯7

AI大厂系统提示词泄露:2.7万token里,藏着最好的提示工程课

GitHub上`system_prompts_leaks`仓库扒出Claude、GPT等AI系统提示词。这些提示词像事故档案,规则具体,其结构排序暴露优先级。普通使用者可借鉴,提升对AI提要求的质量。

AI Reading Hub
新闻资讯8

0.7nm制程芯片问世!摩尔定律又活了

IBM推出全球首款0.7纳米芯片制程节点,指甲盖大小芯片可集成近1000亿晶体管,性能或能效大幅提升。靠‘纳米堆叠’架构实现突破,最早5年内量产,有望让芯片微缩延续十年。

量子位
产品应用7

3D-AIGC 存储架构演进:从 NFS、Gluster 到 JuiceFS

光影焕像在 3D-AIGC 存储上,因三维模型数据量大、格式多,对存储要求高。经探索,从 NFS、GlusterFS 到最终选 JuiceFS,搭建统一存储平台,管理上亿文件,提升处理速度,简化运维。

InfoQ
新闻资讯7

国产存储芯片抢抓“超级周期”机遇

自今年第三季度起,存储芯片行业进入‘超级周期’,海外大厂产能向高端转移造成中端供给缺口。本土存储芯片厂商完善中低端布局、量产产品、取得高端进展,有望填补空白、提升话语权。

芯师爷
算法论文8

首篇潜空间推理综述!模型思考不必依赖Token,带宽暴增2700+倍

史上首篇潜空间推理综述全面总结新兴推理范式,分析循环、递归等推理形式并总结成框架。潜空间推理用潜式思维链,带宽比显式CoT提升2700多倍,还介绍无限深度推理实现途径。

量子位
7

国产大模型高考出分了:裸分683,选清华还是北大?

字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。

量子位