「大厂推虾苗」共找到 5557 篇相关文章
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。
加拿大丛林迷路五小时,ChatGPT救命神技,比地图还靠谱!
一群人在加拿大森林迷路5小时,手机电量低、Google Maps失灵,靠向ChatGPT发实时坐标获导航指引脱险。此外,上海交大团队推出PathGPT,用大模型让导航可自然对话,虽有不足但潜力大。
盘一盘,2017年Transformer之后,LLM领域的重要论文
本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构的论文成现代AI基石;介绍GPT - 3的论文确立‘大模型 + 大数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。
ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解
在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。
YC最新总结顶尖的提示词应该怎么写?
提示工程在大模型时代愈发重要,其核心在于提示词设计。近日,YC在播客分享从与大模型创业公司学到的提示工程实践,涵盖核心原则、进阶技巧、企业级实践、创业者模式等内容。
谷歌推出“神经操作系统”原型,Gemini 2.5 Flash驱动,UI即时生成无需编码
谷歌开发者博客展示由大模型驱动的“神经操作系统”研究原型,由Gemini 2.5 Flash - Lite驱动,屏幕由大语言模型即时生成。介绍了实现UI即时生成等的核心技术理念,虽为原型但应用前景好。
你们催更的模型,云栖大会一口气全发了!
云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智等,各模型能力升级显著,现已同步上线。
挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因
随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。
刚刚,OpenAI发布白皮书:如何在AI时代保持领先
AI发展超多数企业适应能力,早期采用者收入增长更快。9月3日OpenAI发布白皮书,总结与大企业合作经验,给出从战略到治理的五大核心原则及多方面重点建议,助企业在AI时代保持领先。
Agent引爆产品新思维、奇点智能研究院正式成立!2025 全球产品经理大会首日精彩速览
8月15日,2025全球产品经理大会开幕,众多专家分享见解。奇点智能研究院成立,聚焦AI多范式转换设六大研究领域。李建忠、方汉等嘉宾探讨AI产业生态、产品创新等,还涉及GenAI交互设计、AI产品“人味”等内容。