语音基准」共找到 1125 篇相关文章

新闻资讯7

GPT-5.2考赢人类!OpenAI警告:大模型能力已过剩,AGI天花板不是AI

GPT - 5.2在ARC - AGI - 2基准测试超人类,Poetiq系统让其准确率从60%提至75%。OpenAI称大模型进入‘能力过剩’阶段,未来AGI进展不止靠模型,更需人机协同。

新智元
新闻资讯7

CES 2026「最烂」产品大赏

CES 2026 展会中消费者权益倡导者颁出最烂产品奖。如三星冰箱语音开门易失灵;亚马逊 Ring 门铃侵犯隐私;Lollipop Star 棒棒糖产生电子垃圾,还介绍了博世等公司部分产品情况。

机器之心
新闻资讯8

谷歌2025年终回顾:Gemini 3领衔,六大领域全线突破

本文回顾谷歌2025年发展,从Gemini 1.5 pro开始有变化,到Gemini 2.5 pro质变。谷歌在模型、产品、创意、科学等六大领域突破,如Gemini 3系列模型表现出色,但Sam Altman仍认为谷歌失败。

AI寒武纪
算法论文8

AAAI 2026 Oral | 拒绝「一刀切」!AdaMCoT:让大模型学会「看题下菜碟」,动态选择最佳思考语言

多语言大模型面临语言选择难题,现有跨语言推理方法存在缺陷。新加坡研究团队推出AdaMCoT框架,通过自适应路由机制动态选语言推理,提升跨语言事实推理准确性与一致性,效果超越传统方法。

机器之心
算法论文8

Meta通过简单算术解锁LLM SoTA性能

大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。

深度学习自然语言处理
算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。

机器之心
算法论文8

科研智能体「漫游指南」—助你构建领域专属科研智能体

该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。

机器之心
算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心
新闻资讯8

GPT-5,AI的「登月时刻」来了!奥特曼现场发布,三位一体博士级智能体

GPT-5正式发布,它是融合模型,准确性大幅提升,编程、写作等能力飞跃,语音模式升级,还有个性化功能,已介入医疗。API含三款模型,价格有竞争力,标志AI竞争转向「智能发布」。

新智元
新闻资讯7

GPT-5的所有传言,以及,Sora 2?

OpenAI今晚1点举办直播,GPT - 5将亮相。发布前关键信息汇总,包括直播时长变长、GitHub泄露四个版本、三档定价策略、突破人类基准测试等,还或同步发布Sora 2。

AGI Hunt