「大模型应用」共找到 10287 篇相关文章
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换
视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。
3.4K星Apple出品FastVLM:视觉TTFT效率提升85倍,凭啥这么牛!
文章指出VLM在实际生产应用中因高分辨率图像存在效率问题,介绍Apple出品的FastVLM解决方案,阐述其架构、训练过程,展示在多个基准测试的性能,凸显在高分辨率输入下提升效率的优势及实际应用价值。
a16z 提出 AI 产品的「水晶鞋效应」:第一批用户反而是最忠诚的
OpenRouter 报告基于 300 多个模型、100 万亿个 token 交互数据,分析 LLM 应用情况。提出「灰姑娘水晶鞋效应」,即 AI 模型首批用户留存率更高,与传统 SaaS 玩法相悖,还通过案例分析其表现及对 AI 创业的影响。
Yann LeCun终于被小扎“逼得”离职创业了!内行被外行指导、时刻担心被裁,Meta 人现在迷茫又内卷
据《金融时报》报道,Meta 首席 AI 科学家 Yann LeCun 计划离职创业。他对 Meta 内部变化不满,与扎克伯格在 AI 路线有分歧。Meta 近年动荡,员工迷茫内卷,高层决策引诸多问题,还要求元宇宙部门用 AI 提效。
Dexmal原力灵机开源Dexbotic,基于PyTorch的一站式VLA代码库
Dexmal原力灵机推出基于PyTorch的开源视觉-语言-动作模型(VLA)代码库Dexbotic,面向具身智能研究者。其架构含三大核心组件,有五大特征,还推出开源硬件,未来将持续投入生态建设。
一文读懂鲸智百应:驱动组织进化的企业AI操作系统,让企业从「用AI」到「是AI」
在2025云栖大会上,浩鲸科技推出「鲸智百应」企业AI操作系统。它从六大维度让企业成「AI原生组织」,如统一认知搭建底座、智能执行让AI成主力等,助力企业解决AI应用根本问题。
ICML 2025杰出论文出炉:8篇获奖,南大研究者榜上有名
本周一,ICML 2025公布最佳论文奖项,共8篇获奖,含6篇杰出论文奖、2篇杰出立场论文奖,南京大学研究者上榜。大会投稿量持续增长,展示AI领域火热。文中介绍了各获奖论文的研究内容与成果。
BeyondSWE:AI编程80分是真的强,还是考卷太简单?
前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。
推理速度飙升5倍,苹果提出全新Multi-Token生成框架!
自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。
Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!
时隔5个月,xAI发布通用模型Grok 4,后续还将推三款模型。Grok 4上线,有三个订阅版本。马斯克称其智能超博士生,多项基准测试领先,编码或超Cursor。其性能强大源于训练投入和计算扩展。