统一自回归」共找到 1624 篇相关文章

算法论文8

统一架构新思考,北大团队UniWorld-V1统一大模型

北大袁粒课题组提出统一大模型架构UniWorld-V1。通过对GPT - 4o - Image实验,发现其依赖语义编码器提取视觉特征,据此设计架构,在多基准测试表现优异,开源代码等促进研究。

AI寒武纪
新闻资讯8

刚刚!微软 | 发布全新一代研AI芯片Maia 200

微软提前发布研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。

AINLPer
算法论文7

无需外部数据!AI答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位
算法论文8

清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
开源动态8

小扎又开源了:7B实现监督学习SOTA

Meta发布全新开源视觉模型DINOv3,首次证明监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。

量子位
算法论文7

Waver:面向统一图像与视频生成的高性能基础模型

字节提出的Waver是面向统一图像与视频生成的高性能基础模型,支持T2V、I2V、T2I。它引入新架构、结合筛选流程与质量模型。虽有局限,但表现出色,架构设计独特,功能多样。

带你学AI
算法论文8

搜索强化学习SSRL:Agentic RL的Sim2Real时刻

本文由多机构联合完成,引入搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。

机器之心
新闻资讯7

AI查重「杀死」一切!学生93分钟一镜到底证清白

AI时代,教育界信任面临挑战。休斯顿大学学生Leigh Burrell熬夜写的作业被AI检测判为ChatGPT代笔,靠15页证据才洗清冤屈。AI检测工具误判频出,误判率最高达9%,教育界信任正在崩塌。

新智元
推荐文章8

一篇讲透Agent进化飞轮怎么搭:评测→记忆→落地→控制

文章指出多数团队评测、记忆、Self - Improve 拆分做,飞轮难转,原因是环节衔接断链。基于行业研究及实践,提炼评测→记忆→落地→控制四齿飞轮方法论,阐述各环节核心矛盾、建设要点、避坑指南及咬合形成飞轮的方法。

腾讯技术工程
开源动态8

Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序

2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。

通义千问Qwen