「统一模型框架」共找到 8689 篇相关文章

开源动态7

FLUX.2开源了,但是我好像也看到了小公司的无力。

AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小厂在大厂资源碾压下的无力,但开源仍有价值。

数字生命卡兹克
算法论文7

这次,LLM黑盒被LLM打开了~

随着大语言模型(LLM)能力提升,其内部机制更不透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。

PaperAgent
新闻资讯8

她们估值840亿,刚发了第一个AI成果

估值超120亿美元的Thinking Machines发布首篇研究博客,由创始人、OpenAI前CTO Mira Murati宣发。研究聚焦克服大语言模型推理中的不确定性,探讨推理结果难复现的根源,还介绍解决办法并验证效果。

量子位
算法论文7

DreamArt!只需一张图,生成可动的可交互物体

生成可动物体是具身智能等领域关键挑战,现有方法有局限。北大团队提出DreamArt框架,从单张图像生成可交互可动物体,经三阶段流程,表现优于基线方法,不过也存在生成不符物理规律等问题。

带你学AI
算法论文8

腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
算法论文8

浙大 × 字节 × 港中深最新研究:告别高斯堆砌,终结 3D 冗余|ECCV 2026

本文解读浙大、字节跳动、香港中文大学(深圳)联合收录于ECCV 2026的PointSplat研究,针对3D高斯溅射的跨视角冗余问题,提出以人为中心的新框架,解决3D表示体积过大问题,适配实时场景。

AI科技评论
新闻资讯8

再封神!OpenAI掀翻AI图像生成,极度逼真,立刻商用

网传OpenAI的GPT-image-2正在灰度测试,韩国网友测试后称其生成图像可‘立刻商用’。它深度融合GPT大语言模型,生成照片更逼真,强化了提示遵循和场景理解能力,让AI图像生成进入‘实用时代’。

AIGC开放社区
产品应用8

全球第一,13个SOTA!我们找到了龙虾界掌管GUI的神

明略科技推出自研 GUI-VLA 智能体模型 Mano-P 1.0,不依赖 API 对接与浏览器场景,可操作桌面软件与网页界面。它在 13 个多模态基准榜单达 SOTA,支持本地运行,数据零上云,采用分阶段开源策略。

机器之心
开源动态7

OpenClaw构建自我迭代AI助手笔记

作者花3天体验OpenClaw,构建银行客户经理助手场景,验证通用智能体框架可用性。介绍Agent构建、迭代、交流及评估能力构建过程,对比OpenClaw与Claude Code、OpenViking,指出记忆系统问题,肯定专属智能体提升生产力的可行性。

阿里云开发者
开源动态8

狂揽 11.8K Star!用大厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!

GitHub上名为PUA的项目狂揽11.8K Star,作者用大厂PUA话术‘驯化’AI,总结了AI的‘五大摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。

开源星探