统一多模态基础模型」共找到 1751 篇相关文章

开源动态8

SGLang 中的 CUDA Graph 进阶指南

本文介绍 SGLang 构建 CUDA Graph 支持及改动。如 Runner/Backend 解耦与灵活组合;首创 Breakable CUDA Graph 并开源,能提高捕获灵活性;还实现 Prefill 的 Full CUDA Graph,同时介绍显存管理方法。

GiantPandaLLM
新闻资讯8

矩阵起源(MatrixOrigin)完成超千万美元A轮融资 | 5Y News

2026年8月6日,企业级AI基础设施厂商矩阵起源完成超千万美元A轮融资,由汉得信息参与投资的基金、亚康股份与Artesian Venture Partners注资。资金用于平台研发、市场拓展等。其产品具优势,获多方认可。

五源资本 5Y Capital
产品应用7

龙虾开始自己拍电影了:我在 LibTV 里看着它从一句话做到成片

作者试用 AI 视频产品 LibTV,仅给 Claude Code 发一句话“「黑神话哪吒」视频制作”,约 10 分钟就得到视频初稿。LibTV 能搭好 0 到 60 的地基,留下可继续创作的画布,成本低还能多尝试,最后仍需人把关。

AI产品自由
算法论文8

10倍加速化学推理大模型!Haven团队在隐空间思考分子式,碾压显示CoT

Haven团队提出LatentChem,把化学推理从‘文本表面’挪到‘模型内部’,先在隐空间思考,再在语言空间回答。它拆分‘推理’与‘表达’,性能优异,为AI Scientist奠定基础

量子位
产品应用8

可灵3.0系列模型正式上线:属于每个人的导演时代来临

可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。

AI科技评论
算法论文8

哈工大最新研究AI Meets Brain

传统大模型有“健忘”问题,哈工大《AI Meets Brain》研究借鉴人类记忆机制,为AI智能体打造强大记忆系统。研究涵盖核心洞察、记忆形态、分类框架等内容,还探讨了记忆赋能方式及未来发展方向。

CourseAI
新闻资讯7

中国 AI 正处于反超美国的前夜

2025下半年中美AI圈有新现象,一是认可中国AI崛起或反超,如海外企业用通义千问,MiniMax开源模型编程能力强;二是资本豪赌与泡沫风险加剧。中国AI成本低、性能优、ROI高,MiniMax或成中国版OpenAI。

AI科技评论
开源动态7

被DeepSeek带火的OCR,最新8个开源模型盘点~

DeepSeek-OCR发布让OCR大热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。

PaperAgent
产品应用7

释放创造力:解密 AI 贴纸生成器的“神级”提示词模板

文章介绍日本网友分享的 Gem 应用,可上传照片生成各种风格贴纸。详细阐述提示词模板概念、规律特点,还给出波普艺术、日式复古火柴盒等多种贴纸风格提示词库及可用情绪列表,最后鼓励读者动手尝试。

宝玉AI
开源动态8

苹果端侧AI两连发!模型体积减半、首字延迟降85倍,iPhone离线秒用

苹果在Hugging Face放出FastVLM与MobileCLIP2两条多模态主线。前者主打「快」,首字延迟压到竞品1/85;后者突出「轻」,体积减半。模型和Demo已开放,开发者可集成开发。

新智元