全双工模型」共找到 8671 篇相关文章

算法论文8

GUI 精准定位新 SoTA:LASER 让模型从“看图”走向“锁重点”

多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理
开源动态8

超低延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完开源,有超低延迟等优势。

开源星探
算法论文8

可攻可防,越狱成功率近90%!六大主流模型中招 | EMNLP'25

研究人员聚焦大型语言模型(LLMs)安漏洞,提出新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。

新智元
新闻资讯7

Le Chat方面对标ChatGPT,欧洲AI新贵穷追不舍

欧洲AI初创公司Mistral AI接连发布多个开源模型,还升级Le Chat,引入深度研究、语音等新功能,方面对标ChatGPT。其语音识别模型Voxtral号称“球最佳”,多方面超越竞品。

机器之心
开源动态8

能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务上超越顶尖闭源模型,多模态综合能力领先主流开源模型

OpenMMLab
算法论文8

迈向原生模态AI智能体:人大&小红书发布OmniGAIA新基准

中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来模态智能体发展方向。

PaperAgent
开源动态8

真实评估!北理发布球首个「场景教育」基准,支持4000+情境

北京理工大学高扬老师团队推出EduBench,是球首个「场景教育」基准,涵盖9大教育场景、12个评估维度、超4000个情境。团队将数据、模型面开源,评估发现大模型在特殊教育场景有不足,还提出多源知识蒸馏等方法。

新智元
新闻资讯8

不只是DeepSeek V4,还有个万亿级大模型,训推程国产芯片

2026年4月24日,DeepSeek发布新一代模型DeepSeek - V4系列预览版并开源。同日,美团用国产算力集群训练出万亿参数大模型LongCat - 2.0系列预览版,训推流程摆脱英伟达,在国产算力支撑万亿级模型研发上取得突破。

机器之心
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型

上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在多领域表现出色。

AIGC开放社区
新闻资讯8

AI秒破18世纪「天书」账本!谷歌新模型盲测刷屏

谷歌AI Studio上一神秘模型引发关注,它识别200多年前商人的「天书」账本,修正格式错误与模糊表述,推理能力令历史学家震惊。该模型解决手写识别和推理两大难题,或为谷歌将推的Gemini - 3。

新智元