大模型后训练」共找到 9527 篇相关文章

开源动态8

腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley

腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三核心优势,能适配多种场景,抑制底噪,保证音频保真度。

带你学AI
推荐文章7

评论送书 | 一文读懂多Agent系统演进趋势

文章指出多Agent系统成模型应用重要方向。分析模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。

AIGC开放社区
开源动态8

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

香港学、香港科与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。

机器之心
产品应用8

涨240%,Doc-Researcher确立多模态文档深度研究新范式

在ChatGPT引领的AI革命中,语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。

PaperAgent
新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
开源动态8

狂涨26.5K star!一个接口搞定20+AI模型,开箱即用,太香了!

文章介绍开源项目One API,它是LLM API管理与分发系统,能统一管理主流AI模型,用一个接口搞定调用。有友好界面和可视化操作,在Github获26.5K star,还介绍其性能特色、安装使用方法。

开源先锋
开源动态8

500美元刷新SOTA!训练成本砍到1/200,华人团队重构视频生成范式

香港城市学等团队发布图像 - 视频生成模型Pusa V1.0,在基础模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
新闻资讯7

刚刚,模型棋王诞生!40轮血战,OpenAI o3豪夺第一,人类师地位不保?

国际象棋积分赛成果出炉,OpenAI o3以人类等效Elo 1685分夺冠,Grok 4和Gemini 2.5 Pro紧随其后。Kaggle发布国际象棋文本排行榜,评估模型战略推理等能力,还推出相关数据集,虽有局限但意义重

新智元
新闻资讯7

谷歌突袭发布AI应用,无需Wi-Fi、手机就能跑模型!网友实测两极分化

谷歌推出 Google AI Edge Gallery 应用,可在 Android 设备离线运行 AI 模型。它有本地运行、智能选模等特点,响应快且隐私性好。不过网友实测评价不一,有人认为它是旧技术包装,还被指比 Core ML 落后。

InfoQ
开源动态8

NeurIPS 2025 | Code Graph Model:重塑代码模型架构,利用“代码图”突破仓库级编程瓶颈

在 NeurIPS 2025 上,蚂蚁全模态代码算法团队展示「Code Graph Model (CGM)」,它将代码库图结构注入 LLM 底层注意力机制,打破业界刻板印象,在权威榜单上表现出色。文章解析其架构、训练策略和配套框架。

AINLPer