「文图生成模型」共找到 8652 篇相关文章
小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一
6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。
一张图生成任意场景3D模型,部分遮挡也不怕|IDEA x 光影焕像联合开源
IDEA研究院张磊团队与香港科技大学谭平团队联合推出SceneMaker框架,以DINO - X与Triverse为基础,实现从任意开放世界图像到带Mesh的3D场景完整重建,解决遮挡难题,有多项创新,应用场景广泛。
Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o
Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。
不会拍照有招了!北大彭宇新团队开源首个美学指导大模型Venus,帮你拍好照|CVPR 2026
北大彭宇新教授团队针对现有大模型在摄影指导上的不足,定义美学指导任务,构建数据集AesGuide,提出美学指导大模型Venus。相关论文被CVPR 2026接收并已开源,Venus在多项评测中优于现有方法。
ACL 2025预定爆款!HyperGraphRAG横扫5大领域,检索效率提升7倍
文章聚焦HyperGraphRAG模型,介绍其架构由知识超图构建、超图检索策略、超图引导的生成机制组成,阐述构建步骤,该模型能提升检索效率,或成ACL 2025爆款。
图像界的DeepSeek!12B参数对标GPT-4o,5秒出图,消费级硬件就能玩转编辑生成
Black Forest Labs开源旗舰图像模型FLUX.1 Kontext[dev],专为图像编辑打造,能在消费级芯片运行。12B参数少、推理快,性能媲美闭源模型。有诸多特点,经优化训练,在KontextBench基准表现优。
开源屠刀!400美元炼成「代码副脑」,硅谷天价模型成废铁
AI2开源Open Coding Agents,以最低数百美元算力成本,能训练贴合私有代码库的专属编程智能体。SERA-32B表现惊艳,其软验证生成技术降低成本,新代码易部署且兼容Claude Code。
南科大教授余沛源创业做AI+材料:真正难的不是生成,而是验证
南科大教授余沛源创业成立三向纪元,构建可验证材料模型。他认为AI+材料研发难在验证,当下是产业化窗口期,中国有优势,初创企业与大厂各有优劣,公司有独特技术与商业模式。
大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲
Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。
中国团队引领太空算力:首次太空在轨部署通用大模型,发2800颗卫星服务数亿硅基智能体
岁末年初,全球AI竞争聚焦太空算力,中美你追我赶。美国Starcloud宣布在太空跑通大模型,中国国星宇航发布全球首个服务硅基智能体的太空算力网,计划用2800颗卫星服务数亿个硅基智能体,还实现通用大模型在轨部署。