推理市场」共找到 2672 篇相关文章

开源动态7

Qwen拿半成品刷下AIME'25满分,给别人留点面子吧……

开源之王Qwen的Qwen3“超大杯”推理版虽为早期预览版,仍在训练中,但已在AIME 25和HMMT25达100%准确率,超GPT - 5系列。该预览版可在Qwen Chat免费试用,API已上线阿里云。

量子位
算法论文8

斯坦福、英伟达和伯克利提出具身Test-Time Scaling Law

斯坦福、英伟达和伯克利团队提出具身Test - Time Scaling Law。研究发现推理时增加计算量可提升VLA模型性能,揭示动作误差与采样数量幂律关系,还探讨关键问题,给出方法,实验证明结合RoboMonkey能显著提升性能。

机器之心
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
开源动态8

开放全栈!超越π0,具身智能基础大模型迎来真·开源,开发者狂喜

继π0后,具身智能基座模型WALL - OSS正式开源,多项指标超越π0。它是通用多模态具身模型,具良好推理和泛化能力。背后自变量机器人刚完成近10亿A + 轮融资,开源将降低具身智能门槛。

量子位
新闻资讯8

吴恩达:一边是CS毕业生“过剩”,一边是AI人才抢破头,问题出在哪?「cs专业依然是王牌」

吴恩达分享对CS专业人才市场的观察,指出市场对AI开发者需求未满足,而新毕业CS学生失业率上升。根源是高校课程未跟上AI提升编程生产力的步伐,还阐述了AI工程师核心能力及人才短缺趋势等。

AI寒武纪
新闻资讯8

GPT之父把AI扔回1930年:没见过一行代码,却「发明」了Python!

GPT之父Alec Radford带队发布总参数130亿的大模型「talkie」,其训练数据冻结在1930年,没学过编程却能写Python代码,证明LLM可用旧知识推理。团队后续还有升级计划。

新智元
产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。

AIGC开放社区
新闻资讯7

The Batch: 901 | 医疗健康聊天机器人争相登台

OpenAI和Anthropic在医疗健康市场布局,OpenAI发布面向消费者的ChatGPT Health,可调取医疗信息,有安全隐私措施;Anthropic推出面向医疗专业人士的Claude for Healthcare,可加快文书处理。此前谷歌健康摘要功能因错误信息被撤。

DeeplearningAI
开源动态8

DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?

凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。

PaperAgent
产品应用8

用AI“打开”金融市场黑盒:微软亚洲研究院如何构建订单级仿真引擎

在大模型与智能 Agent 崛起的时代,金融行业变革不断。微软亚洲研究院刘炜清在 AICon 大会分享,团队构建金融基座模型与 Agent 流程,实现高保真市场模拟与决策优化,还介绍了相关平台和模型构建应用。

InfoQ