速度和准确性」共找到 7306 篇相关文章

推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发大会的分享。介绍大模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推任务;还提及模型评估方法。

InfoQ
产品应用8

一家低调的工业AI公司,用TPT跨越生成式AI鸿沟|甲子光年

麻省理工学院报告指出约95%生成式AI企业试点无实质回报,存在生成式AI鸿沟。工业AI落地难,中控技术的TPT及TPT 2模型,在兰州石化榆林化工应用效果好,其优势源于数据行业经验,也体现了破局决心。

甲子光年
开源动态8

8B模型任务击败GPT-5?阶跃星辰开源Deep Think新框架,小模型解锁百万Token测试时计算

阶跃星辰推出并行协同推理框架PaCoRe,让大模型突破上下文窗口处理速度限制。基于此框架,小模型能解锁百万级Token测试时计算。PaCoRe - 8B在数学基准测试中超越GPT - 5,还具备前沿性能、“综合”能力涌现等优势。

机器之心
新闻资讯7

GPT-5攻入数学圈,证明定理快过博士生?网友热议AI新角色

9月初,arXiv一篇论文将GPT - 5写进数学研究成果。它解决了第四矩定理‘收敛速度’的空白,还在凸优化领域提升收敛界限。不过它常犯错,需人类引导,且成果原创性存疑,引发对科研博士培养的担忧。

新智元
新闻资讯7

Gemini 3.5 Pro绝密泄露,前端赶超Fable 5!

全网被Gemini 3.5 Pro泄露刷屏,传闻7月17日发布。它在前端生成表现出色,一次成型、精准零失误,性能超Fable 5,但在硬核推理等任务上不如Fable 5GPT - 5.6。谷歌为其重预训练,还准备对标GPT - Image 2的图像模型。

新智元
新闻资讯7

DeepSeek一体机最新观察:满血版卖不动了,市场抢食零散的中低端机型生意

本文聚焦DeepSeek一体机市场,上半年国央企等大客户采购高端机型需求旺,头部硬件厂商营收可观,中小厂商冷清。下半年高端市场饱,中低端机型“游击战”开打,部分厂商用国产芯片降成本,部分有政府关系的新厂商入局。已售一体机落地难,需杀手级应用用户数据。

AI科技评论
新闻资讯7

李飞飞引爆的3D新技术,为什么这家深圳公司两年前就“玩腻”了?

李飞飞宣布可在任意设备流式传输超1亿个高斯泼溅,引发对3DGS的关注。其实深圳其域创新两年前就推出相关产品并开源。3DGS面临传输、加载生态问题,现正从展示介质变为生产力工具,其域方案成底层支撑。

量子位
算法论文8

RL加持的3D生成时代来了!首个「R1 式」文本到3D推理大模型AR3D-R1登场

强化学习首次被系统性拓展到文本到3D生成领域,上海人工智能实验室等机构研究者提出首个强化学习增强的文本到3D自回归模型AR3D - R1,还提出Hi - GRPO范式MME - 3DR基准,实验显示其性能优异。

机器之心
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
开源动态8

中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型

360推出FG-CLIP2图文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看图,中英文皆强且已开源。其优势源于高质量数据集先进训练方法,还在多业务落地并开放API。

机器之心