金融推理大模型」共找到 8225 篇相关文章

开源动态8

2 天斩获 3.5K 标星!GitHub 惊现神器!一个二进制文件把 DeepSeek V4 搬进终端

GitHub上的DeepSeek TUI项目开源两天获3.5K Star,它把DeepSeek V4模型搬进终端成编码智能体,有原生RLM并行推理等亮点,提供多种安装方式、支持多提供商,适合终端开发者。

开源星探
开源动态8

Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍

Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理模型个性化等场景。

AI寒武纪
推荐文章7

GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI

本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理模型发展、训练方式及 OpenAI 研究情况等。

海外独角兽
算法论文8

AI数学能力暴涨100%,自进化直逼RL极限!CMU新作颠覆认知

数据枯竭成AI发展瓶颈,CMU团队提出SRT方法,让LLM自我进化,提升数学与推理能力,性能逼近传统强化学习。研究还分析其局限,提出缓解奖励作弊策略及应对模型崩溃的方法。

新智元
产品应用8

缓存不该困在一台服务器里

本文分析大模型推理阶段KV缓存的行业痛点,指出传统单机缓存孤立无法跨节点复用的问题,介绍焱融科技的分层共享缓存方案,公开了方案的实测性能数据,展现AI存储的新发展方向。

InfoQ
算法论文8

ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代

随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。

机器之心
新闻资讯8

黄仁勋,开启智元(Token)时代

全球大模型进入千万亿智元(Token)时代,OpenRouter年化智元用量突破一千万亿,对应推理支出约10亿美元。黄仁勋在GTC大会提出「智元(Token)经济学」,智元成AI时代核心经济标尺,重塑产业规则。

新智元
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
产品应用7

Claude Opus 4.7,全网差评!刚升级就翻车,用户怒斥:还我4.6

Claude Opus 4.7刚发布就遭全网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。

新智元
产品应用8

阿里新王牌千问 APP 曝光:全面硬刚 ChatGPT

11月14日阿里开启「千问 APP」公测,其集成通义千问 Qwen 系列顶尖模型,有多模态能力。它对标 ChatGPT,在中文语境和结构化输出上有优势,实测处理财报、麻将推理等表现佳。

特工宇宙