多语言识别」共找到 4971 篇相关文章

算法论文8

无需验证器的RL:RLPR解锁LLM通用推理潜能

现有依赖强化学习与可验证奖励(RLVR)提升大语言模型(LLM)推理能力的方法,受限于领域特定验证器。本文提出RLPR框架,利用LLM生成正确答案的固有概率作奖励信号,实现无需外部验证器的通用领域强化学习,效果显著。

深度学习自然语言处理
产品应用7

搜狗输入法,居然还在更新??

在腾讯微信输入法上线、各类AI新产品轰炸的当下,搜狗输入法进行20.0 AI大版本升级。它有AI文本翻译、轻声识别等功能,用AI大模型全面重构,还接入腾讯混元、DeepSeek R1大模型,免费提供AI服务。

量子位
产品应用8

“参考生”之王回归:Vidu Q3持续进化,剧张力拉满|甲子光年

近期,AI视频公司生数科技的Vidu Q3正式上线参考生视频并全面升级。它能解决视频内容创作痛点,让爆款人设等稳定复现。在榜单上表现出色,经测试在场景降本增效,提升了视频“剧张力”。

甲子光年
7

GPT-5两周内发布,内测猛料流出?GPT-6或已开始训练,奥特曼剧透百万GPU

有爆料称GPT-5将在两周内发布,是模型组成的系统,含「路由器」,GPT-6已在训练。奥特曼称年底将增超百万GPU,有人看好GPT-5,也有人认为它可能只是路由器。此外,OpenAI有十名员工拒小扎3亿天价offer。

新智元
新闻资讯8

马斯克发布 Grok 4 模型:推理能力较前代提升 10 倍,各学科测试接近满分

xAI 发布 Grok 4 及 Grok 4 Heavy 模型,推理能力较前代提升 10 倍,测试接近满分。马斯克称其为世界最好 AI。它在方面表现出色,如长任务能力强、推理效率佳等,但代码能力欠佳,且付费昂贵。后续还将推款模型。

Founder Park
推荐文章8

AI 基础知识从 0.5 到 0.6—— Transformer 架构为何能统治AI领域?

文章围绕Transformer架构展开,先介绍其诞生背景,对比CNN、RNN等模型,阐述其在领域的核心地位。接着剖析工作流程、实现原理,包括QKV机制、头注意力等。最后列举T5、GPT等常见架构模型,并提及通义千问3与MCP协议。

阿里云开发者
推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。

InfoQ
新闻资讯8

陶哲轩用GPT5-Pro跨界挑战!3年无解的难题,11分钟出完整证明

陶哲轩与GPT - 5 Pro合作解决微分几何领域3年未解难题。GPT - 5 Pro从计算到证明一气呵成,助陶哲轩突破思维局限。陶哲轩认为AI在小、大尺度上有用,中尺度无益,还印证尺度衡量工具有效性观点。

量子位
算法论文8

MSRA首测AI从零建仓库:能写、能跑,但不一定对丨ACL'26

微软亚洲研究院工作RepoGenesis被ACL 2026高分录用,它是面向语言、仓库级、端到端Web微服务生成的基准。输入贴近实际,用维度评测开源Agent和商业IDE,还拓展模型微调。但也有边界,未模拟真实复杂需求。

量子位
产品应用8

Luma Uni-1.1 API开放,图像模型榜单第三,文字渲染直逼GPT image 2

今年图像生成模型迭代快,海外AI初创公司Luma将统一图像模型Uni - 1升级到1.1版并开放API。它在榜单排名前三,价格与延迟低,有诸品牌客户接入。展示了场景应用效果,技术路线独特,定价有优势。

机器之心