行为金融学实验」共找到 1613 篇相关文章

开源动态8

EMNLP 2025 | CARE:无需外部工具,让大模型原生检索增强推理实现上下文高保真

MetaGPT等机构团队发布CARE框架,可让LLM将推理上下文与自身检索能力结合,已全面开源。它提出原生检索增强推理范式,采用两阶段训练策略,在问答基准实验中表现出色,为解决模型问题提供新路径。

机器之心
开源动态8

首个开源实现100%可复现的稳定RL训练框架来了!2次结果完全重合

SGLang团队联合slime团队开源实现100%可复现的稳定RL训练框架。基于Qwen3 - 8B重复实验结果完美重合。SGLang在批次不变算子基础上实现确定性推理,性能有下降但有提升空间,还给出使用方法和未来规划。

量子位
算法论文8

隐形束缚:RLVR为何无法突破LLM的推理边界?

大型推理模型进展依赖带可验证奖励的强化学习(RLVR),但它能否扩展模型推理能力存疑。本文通过理论证明与实验,揭示RLVR存在“隐形束缚”,只能在基座模型初始能力内优化,难以发现新解。

深度学习自然语言处理
算法论文8

ICLR2026|东方理工大学、上海交通大学等:GenSR:把“离散的公式搜索”变成“连续的地图寻优”

符号回归(SR)目标是从观测数据自动发现数学表达式,但经典方法在离散方程空间搜索有局限。东方理工与上海交大团队提出GenSR,将方程世界重参数化为连续隐空间,用双分支CVAE构造并搜索,实验效果良好。

力学与人工智能
开源动态8

马斯克兑现承诺,开源X推荐算法!100% AI驱动,0人工规则

1月11日马斯克宣布7天内开源X平台推荐算法,如今承诺兑现。新算法由Grok驱动,全AI化,移除人工规则。它双引擎驱动信息流、15种行为预测打分,还揭示过滤机制与设计理念,为创作者提供曝光建议。

新智元
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
算法论文8

ACL 2026 | Spatial-Agent:地图Agent全新概念转换范式

论文 'Spatial-Agent' 提出地理空间问答应建模为 'concept transformation',引入 GeoFlow Graph 中间表示。它从自然语言问题构建图结构,再映射到工具调用。实验显示其对地图任务有帮助,还指出构建地图类 agent 需稳定数据源等。

PaperAgent
新闻资讯8

Anthropic CEO:1 到 5 年内,50% 的白领岗位将被 AI 取代

Anthropic CEO Dario Amodei 在采访中直言,1 到 5 年内金融、咨询等领域大量基层白领岗位将被 AI 取代。他认为 AI 进步快,虽有潜力治病供能,但也会致岗位消失,还提出教育和政府介入应对之策。

AGI Hunt
开源动态8

社区供稿 | Index-AniSora 技术升级开源: 动漫视频生成强化学习

B站升级动画视频生成模型Index - AniSora技术并开源,支持多种二次元风格视频镜头一键生成。基于相关研究提出首个专为二次元视频生成的强化学习技术框架,构建奖励数据集、训练AnimeReward、提出GAPO优化策略,实验验证其有效性。

Hugging Face
新闻资讯7

OpenAI最新技术报告:GPT-4o变谄媚的原因万万没想到

OpenAI发布技术报告解释GPT-4o更新后“变谄媚”原因,是强化学习及用户记忆等因素共同导致。还分享了上线前未发现问题的缘由及后续改进流程的多方面举措,同时提到对用系统提示词控制模型行为存疑。

量子位