优化方法」共找到 2567 篇相关文章

开源动态8

阿里通义开源「推理+搜索」预训练新框架:小模型媲美大模型,多个开放域问答数据集表现显著提升

阿里通义实验室开源通用预训练框架MaskSearch,引入检索增强型掩码预测任务,兼容两种训练方法。实验显示,它在多数据集提升模型性能,小模型能媲美大模型,还验证了训练方式、策略及奖励函数的效果。

量子位
产品应用7

全新唇同步技术OmniSync,遮挡,侧脸不在话下

唇同步对创建逼真视频内容很重要,但现有方法在身份一致、姿势变化等方面有局限。中国人大携手快手提出OmniSync,引入无需掩膜的训练范式,保证身份和姿态一致,能适应复杂场景,还建立AIGC - LipSync基准。

带你学AI
算法论文7

现实世界的天气能复刻?Weather-Magician实时渲染下雨打雷下雪

传统工业方法在还原复杂现实场景时成本高、质量差,当前算法也难重建和渲染真实天气效果。上海交通大学提出Weather - Magician框架,能重建场景并渲染4D天气效果,对硬件要求低且可实时渲染。

带你学AI
产品应用7

V0 模型直接进驻 Cursor,UI 生成效果炸裂,氛围编码体验再升级。

AI 编码赛道竞争激烈,Vercel 的 V0 发布 AI 模型,可在 Cursor 中使用,还推出新工作流提升 UI 生成效果。文中介绍了 V0 特点、Cursor 设置方法及使用演示,还分析了 Vercel 自研模型的原因。

AI进修生
算法论文8

GCEA-YOLO:给油田装上"防火眼",把抽烟行为检测精度拉高 20.8%

油田抽烟事故损失大,传统检测方法有局限,深度学习模型也面临难题。作者基于YOLOv11n构建GCEA - YOLO网络,含ADown、CSP - EDLAN、GFPN、EfficientHead四个模块,检测精度显著提升,还验证了泛化与稳定性,并给出复现代码。

机器学习AI算法工程
新闻资讯8

50FPS、成本打掉70%,魔芯MoWorld把世界模型带进产业时代

近期,魔芯科技联合浙江大学潘云鹤院士、华为等发布实时交互世界模型MoWorld,推理速度超50FPS,部署成本仅为同规模GPU方案的30%。它全链路优化,将用于多行业,魔芯也完成亿元美金融资。

量子位
7

刚刚DeepSeek宣布大规模扩张,整体至少扩员一倍,全体岗位集体喊人加入

DeepSeek宣布大规模扩张,各部门规模至少扩一倍。其发力点包括底层算力与系统优化、高质量数据、Agent与应用落地及探索Next Level科研。用人反内卷、反官僚,岗位接受实习,还新增AGI核心业务管培生。

AI寒武纪
开源动态7

NVIDIA 入局量子基础设施:Ising 模型主打自动校准与实时纠错

NVIDIA宣布推出开源NVIDIA Ising模型,解决量子处理器校准和纠错问题。它含校准和解码两组件,速度和准确性优,可本地部署。与传统方法不同,它是与硬件无关的开源模型层,社区反馈有期待也有疑问。

AI前线
开源动态8

万帧实时!流式3D重建天花板,被国产开源模型打破了

蚂蚁正式开源 LingBot-Map,这是基于几何上下文 Transformer 的纯自回归流式 3D 重建基础模型。它能在恒定内存下实现超万帧长视频实时三维重建,处理速度约 20 FPS,在多基准测试中超越现有流式方法

机器之心
算法论文8

大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练

字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。

量子位