元能力对齐」共找到 3921 篇相关文章

算法论文8

沉迷贪吃蛇,7B小模型竟变身「数学天才」!几何推理碾压GPT-4o

NVIDIA等团队提出视觉游戏学习ViGaL范式,让7B多模态模型玩贪吃蛇等游戏,使其在数学、几何等任务击败GPT - 4o。游戏培养通用认知与推理能力,不同游戏提升不同推理能力,多游戏训练效果更佳。

新智元
产品应用8

Win版Claude Cowork杀疯了!140雇个全职AI员工,全网首测真香

昆仑万维推出天工Skywork桌面版,专为Windows打造,能调用Claude和Gemini。实测显示,它可高效分类文件夹、提取图片、生成报告等。相比Claude Cowork,其在生态、视觉、模型等方面有优势,还降低了办公门槛。

新智元
算法论文8

SFT「不完全学习」之后,研究的下一个前沿在哪?ACL 2026 腾讯混论文未来方向展望

本文从不完全学习现象出发,展望SFT领域未来研究方向,如未知根因探索、检测方法改进等,还提及推广到其他训练范式、CPT精细化研究等,给出研究优先级和社区建议。

InfoQ
产品应用8

跨本体、长任务、可预测……Motubrain双榜登顶只是一个开始

本文围绕具身机器人展开,指出当前大多具身机器人干活存在局限。Motubrain 双榜登顶,确立通用机器人大脑干活能力参照系,它具备一脑多能、一脑贯通等能力,生数科技已开启产品落地布局。

AI科技评论
产品应用8

扩散语言模型写代码!速度比自回归快10倍

Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能力,但面临与当前CI能力不匹配问题。

量子位
产品应用8

实测可灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测可灵2.5新视频模型,它已灰度内测并登上釜山电影节。与可灵2.1对比,可灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克
新闻资讯8

银河通用完成25亿新一轮融资,具身智能“头号玩家”现身|甲子光年

2026年初具身智能公司融资热起,银河通用完成25亿新一轮融资,估值超200亿。其自主研发具身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,具身智能迈向产业化。

甲子光年
开源动态8

腾讯混AI开源3D世界生成模型!文图即可生成3D沉浸式场景!

腾讯混AI实验室开源HunyuanWorld 1.0,这是业界首个支持沉浸式、探索性和交互性3D世界生成的全开源模型。它能通过文图生成3D场景,为多领域提供支撑,还给出安装和代码使用示例。

开源星探
开源动态8

Qwen3-ASR开源:够稳定,能流式,多语言!

今日正式开源Qwen3-ASR系列模型,含两个语音识别与一个语音强制对齐模型,支持多语种。依托创新技术实现精准稳定识别,1.7B模型多场景达SOTA,0.6B兼顾性能效率,强制对齐模型精度超传统模型。

千问Qwen
开源动态8

图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025

360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。

AI科技大本营