推理大模型」共找到 9487 篇相关文章

新闻资讯7

刚刚,马斯克Grok4干翻谷歌Gemini!o3杀入首届模型对抗赛决战

首届模型国际象棋对抗赛第二轮结果出炉,o3以4比0击败o4 - mini,Grok 4在加赛中战胜Gemini 2.5 Pro,二者挺进决赛。8月7日将迎来终局之战,国际象棋冠军将解说。

新智元
算法论文8

模型汤新做法!Meta|提出“类别专家汤”:SoCE,幅提升模型性能,刷新SoTA!

语言模型领域,提升性能常需高算力、量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。

AINLPer
推荐文章8

高性能计算群星闪耀时

文章介绍高性能计算(HPC)对模型的重要性,回顾中国HPC发展历程,讲述清华高性能所郑纬民等学者贡献,还提及团队在模型训练、推理、存储等方面成果,以及类脑计算等新探索。

AI科技评论
产品应用8

懂方言,通诗词,精通30国语言,阿里发布语音识别模型Fun-ASR1.5

阿里发布语音识别模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本。

千问大模型
新闻资讯8

云栖会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI
开源动态7

美团也开源了模型,但我觉得他们的野心是通用生活Agent。

美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。

数字生命卡兹克
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩逆转,近期在多赛事表现出色。

AI寒武纪
算法论文8

ACL 2026 Main | 不只是调用地图API,Spatial-Agent让模型生成可执行地理分析工作流

语言模型在空间领域应用广泛,复杂地理分析问题需组织自然语言成可执行流程。Spatial - Agent 加入 GeoFlow Graph 中间层,借用 GIScience 理论,实验显示能提升准确率,不过仍受数据质量等限制。

机器之心
新闻资讯7

模型是「躲在洞穴里」观察世界? 强化学习佬「吹哨」提醒LLM致命缺点

加州学伯克利分校副教授、强化学习牛Sergey Levine在博客指出,当前语言模型(LLM)只是对人类脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。

机器之心
开源动态8

全新OCR将图片变代码无损重绘!华中科&小红书发布3B模型,图形重建超越Gemini 3 Pro

华中科技学与小红书联合推出MOCR,提出「解析一切」新范式,将文档图形升级为「一等解析目标」。它解决传统OCR短板,在文档解析和图形重建表现出色,还革新评估方法,代码和模型已开源。

量子位