金融领域」共找到 1821 篇相关文章

算法论文8

阿里:RL强化LLM推理,是技巧还是陷阱?

近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。

深度学习自然语言处理
开源动态7

三重Reward驱动的运维智能体进化:多智能体、上下文工程与强化学习的融合实践

文章阐述了AI原生时代下,面向技术风险领域的智能体系统(DeRisk)的架构设计、核心理念等。介绍运维智能体发展现状,提出其技术演进需找三类Reward,还介绍相关概念、DeRisk架构,给出实践案例并将开源技术产品。

阿里云开发者
新闻资讯8

AI创业,已经没有“出海”这个词了丨量子位沙龙

量子位举办「聊聊出海应用、场景与渠道」沙龙,实战派分享AI出海生存逻辑,涉及搞钱、降本、捷径等方面。指出AI出海下半场是“去AI化”,用户更关注能否解决问题。还介绍了各企业负责人观点与经验。

量子位
产品应用8

不卷速度卷验证,陈天桥MiroMind精准预测15天后黄金价格

陈天桥带队的MiroMind发布新一代重型推理智能体MiroThinker-1.7和MiroThinker-H1,在基准测试中表现优异,超越众多顶尖模型。该模型不仅通用任务强,在科技金融等专业领域也表现亮眼,还能承担真实长链条智力任务。

量子位
新闻资讯8

2026年具身智能进入“上市大年”

2026年开年不到三月,具身智能赛道涌入200亿热钱,7家企业成百亿估值独角兽,超20家明确上市计划。虽2025年该领域有泡沫成共识,但因政策加持、技术突破等因素,投资机构仍重金下注。行业格局分六大派系。

芯师爷
算法论文7

一个运行了80年的算法,我们现在才真正理解它?

近80岁的单纯形法是优化领域基石,广泛用于包裹配送、飞机航线规划等,但此前没人能从理论上完美解释其高效原因。现在,Huiberts和Bach找到了谜题的最后一块拼图,不仅让算法更快,还从理论上解释了现象。

机器之心
新闻资讯8

击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!

在Benjie's Olympics赛事中,星动纪元凭借自研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术研发和场景落地也成果颇丰。

AI科技评论
新闻资讯7

Poe:DeepSeek使用率下降50%,快手崛起、OpenAI暴涨

2025年春季,Poe发布AI模型使用趋势报告。DeepSeek使用率降超50%,OpenAI因文生图功能暴涨。文本、视频、推理、图像和音频5大领域中,各模型表现不一,如快手Kling家族、谷歌Imagen 3家族等有亮眼表现。

AIGC开放社区
新闻资讯7

已证实!清华姚班陈立杰全职加入OpenAI,保留伯克利教职

据机器之心求证,清华「姚班」校友、伯克利助理教授陈立杰已全职加入 OpenAI 开展研究,同时保留伯克利教职。他是理论计算机科学顶尖青年学者,学术成就卓越。

机器之心
新闻资讯7

OpenAI、Anthropic以30万美元年薪狂挖华尔街量化精英,AGI人才争夺战打响!

OpenAI、Anthropic、Perplexity等AI巨头正从量化交易公司疯狂挖人,入门级量化研究员基本工资达30万美元。AI公司举办活动招募,因量化人才专长契合,而华尔街反击受限,这场人才争夺战正升温。

AGI Hunt