「GPU加速」共找到 964 篇相关文章
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。
Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×
Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为大模型与知识库结合提供新范式。
OpenAI 发布公司领导者 AI 行动指南,助力企业发展
OpenAI 2024 年走访超 200 家营收 10 亿美元企业,发现拖慢 AI 落地的是‘领导层叙事缺口’。结合客户实践,总结出对齐、激活、放大、加速、治理 5 个可落地步骤,助企业构建以 AI 为核心的组织。
AI生成苹果Metal内核,PyTorch推理速度提升87%
Gimlet Labs研究显示,AI能自动生成苹果芯片Metal内核,使PyTorch推理速度提升87%,在215个PyTorch模块上平均加速1.87倍。多个模型组合生成最优内核概率更高,不过研究对比方式遭质疑。
山姆奥特曼称OpenAI 有意收购Chrome
OpenAI CEO山姆·奥特曼在晚宴上透露,OpenAI 有意收购 Chrome,认为这能提升自家 AI 浏览器水平。此外,他还谈及 GPT - 5 开发、ChatGPT 相关问题、业务扩张计划等多方面内容。目前因法官考虑强制谷歌出售 Chrome,Perplexity 已报价 345 亿美元参与竞购。
360安全云架构全解,AI智能体如何开启「主驾」新时代?
AI发展加速,网络安全危机加剧。360安全云在ISC.AI 2025大会发布新产品,提出“安全即服务”理念,打造AI驱动的四层架构,发布三大类智能体,为企业提供全生命周期价值交付的安全服务。
深度|Karpathy为何突然加入Anthropic,只能当Dario的「-2」?
5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic预训练团队。他将组建新团队,用Claude加速预训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。
GPT-5.6现身后,下一个Claude Sonnet 4.8又曝光了!
GPT-5.5发布不久,开发者在Codex内部日志发现GPT-5.6,几乎同时,Anthropic的Claude Code源码泄露,炸出Sonnet 4.8、Jupiter等型号。两家公司下一代模型几乎同时曝光,模型迭代节奏在加速。
与Generalist顶峰相见,30天狂吸30亿,千寻智能做对了什么?
2026年4月7日,千寻智能完成新一轮10亿融资,30天内累计融资30亿,由雷军、马云旗下资本领投。其开源具身模型Spirit v1.5展现泛化能力,技术路径获认可。千寻构建多源数据引擎,还通过现实场景数据反哺模型。
OpenClaw 带火了给 Agent 的专用邮箱,刚拿了 600 万美金打造 AI 时代数字身份
今年AI浪潮中,智能体向“数字员工”演变,OpenClaw加速此趋势。AgentMail获600万美金种子轮融资,为AI智能体打造专属邮箱服务,有全功能API交互等功能,还建立安全防范体系,用户增长快。