上科大」共找到 6367 篇相关文章

算法论文8

视频「缺陷」变安全优势:蚂蚁数新突破,主动式视频验证系统RollingEvidence

蚂蚁数AIoT团队论文提出主动式可信视频取证系统RollingEvidence,利用相机卷帘门效应嵌入物理水印,结合AI与概率模型验证,抵御伪造篡改,在检测准确率和防护能力优于传统技术。

机器之心
算法论文8

模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队等最新研究打破传统认知,揭示‘对齐税’现象。提出置信解码策略,在多架构、评测集表现出色,能绕过‘对齐税’,提升推理准确率,且工程开销低,为模型发展提供新思路。

量子位
新闻资讯7

OpenAI华人AI牛集体跳槽Meta!清华北校友各一位,多模态后训练、感知团队负责人全走了

扎克伯格从奥特曼手里挖走4名OpenAI华人顶尖AI人才,包括中、浙、清华、北校友各一位。OpenAI或提高薪酬留人,人才争夺战成本升高,这也是开源与闭源阵营的交锋。

量子位
开源动态8

开源打破“AI黑箱”!集结全球咖,GOSIM Paris 2026带你看懂Agent时代变局

GOSIM Paris 2026在巴黎举办,是面向开发者的开源AI技术会。会由GOSIM主办,CSDN等联合打造,聚焦AI能力落地应用。首日Keynote多位咖探讨AI相关问题,还有三论坛、工作坊、Hackathon等活动。

AI科技大本营
算法论文8

X-SAM:从「分割一切」到「任意分割」:统一图像分割多模态模型,在20+个图像分割数据集均达SoTA

中山学、鹏城实验室、美团联合提出X - SAM,统一图像分割多模态模型。它将分割范式扩展,设计通用输入输出,采用端到端架构和三阶段训练策略,在超20个数据集达最优,为图像分割研究开辟新方向。

机器之心
开源动态8

AI秒懂短视频,快手模型Keye-VL理解力爆表!技术细节全开源

快手全新多模态语言模型Kwai Keye-VL线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
算法论文8

工业级文本转SQL新思路:成本暴降、超3000列超数据库依然稳健

华中与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超规模数据库模式的高精准链接与筛选,以低Token消耗刷新两榜单纪录。

AIGC开放社区
开源动态8

谷歌痛失王座?港贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元
算法论文8

智能体如何学会「想象」?深度解析世界模型嵌入具身系统的三技术范式

长期以来具身智能系统缺预测力,世界模型让智能体有了‘想象’未来的能力。中等机构团队综述将现有研究划分为模块化、顺序、统一三架构集成范式,并指出未来研究方向。

机器之心
算法论文8

模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率表现出色,有望实现“模型能力,小模型成本”。

AINLPer