「多模态提示框架」共找到 2828 篇相关文章
GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026
近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。
OpenAI、Anthropic、DeepMind联手发文:现有LLM安全防御不堪一击
OpenAI、Anthropic、Google DeepMind 联手发文,研究语言模型安全防御评估。指出现有防御评估有缺陷,提出通用自适应攻击框架,成功绕过 12 种防御机制,多数攻击成功率超 90%。
创始人拒绝投资13年、仅有几十人的开源项目斩获81k+ GitHub star,用户破百万!网友:他一个人拯救了PHP
Laravel 是现代 PHP 框架,由 Taylor Otwell 于 2011 年创建。该项目坚持开源 13 年,获 81k+GitHub star、用户破百万。2024 年 9 月获 Accel 5700 万美元 A 轮融资,开启商业化新篇章。
MUSA获得SGLang主线支持!5月10日北京,AI Meetup等你来
5月10日北京将举办「SGLang × MUSA」技术沙龙。契机是摩尔线程MUSA后端加入SGLang官方支持体系,代码合入主线,开发者可原生调用摩尔线程GPU。还将探讨框架适配、算子编译等议题。
单卡2秒生成一个视频!清华联手生数开源TurboDiffusion,视频DeepSeek时刻来了
清华大学TSAIL实验室和生数科技联合开源视频生成加速新框架TurboDiffusion,能让视频生成在保证质量下最高提速200多倍,单张显卡就能运行,还整合四项关键技术,有诸多应用意义。
智能流体力学专题研讨会特邀报告3|边鑫:混合深度学习与迭代方法的粘性不可压流动加速求解
2026年8月,第十四届全国流体力学学术会议在青岛举行,智能流体力学专题研讨会展示了人工智能与流体力学交叉领域进展。边鑫作《混合深度学习与迭代方法的粘性不可压流动加速求解》报告,介绍HyDEA求解框架。
AI应用开发与落地实践:从“能用”到“好用”的惊险一跃
本文深入剖析2025年AI应用开发四大核心范式与实践。涵盖AI Agent爆发、RAG技术深化、垂直AI落地及多模态应用,为开发者提供实战指南,助其将技术转化为成功产品。
一把Claude Code 的解剖刀
文章介绍用抓包技巧了解Claude Code,还推荐项目claude - trace。它能查看Claude Code系统提示、工具输出等信息,有对话索引功能,采用前后端架构,可助学习构建AI Agent。
11位顶尖数学家发了篇没结果的论文,陶哲轩推荐都关注一下
11位顶尖数学家发起First Proof实验,设计10道研究级数学问题,检验AI独立解决问题的能力。陶哲轩认为实验有趣,当前AI一次性提示难解题,截止期限前成果值得关注。
卡内基梅隆大学开源LegoGPT,用AI设计乐高模型
卡内基梅隆大学开源LegoGPT,可依文本提示生成物理乐高模型。它把乐高设计转为自回归文本生成任务,基于LLaMA - 3.2 - 1B - Instruct微调,应用场景广泛,如教育、玩具设计等。