金融研究智能体」共找到 5003 篇相关文章

算法论文8

大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
推荐文章7

当 Token 成为商品,AI 基础设施会怎么变化?

在大模型时代,智能生产和交付未实现工业化,存在性能鸿沟。九章云极提出AI工厂战略,发布Alaya NeW Cloud 3.0,将从资源计量转向智能计量,打造训练和Token工厂,提升算力到有效Token的转化效率。

InfoQ
推荐文章7

GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI

本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理、模型发展、训练方式及 OpenAI 研究情况等。

海外独角兽
新闻资讯8

梅卡曼德获豪华基石阵容认购:具身智能眼脑手第一股即将挂牌|甲子光年

8月24日,梅卡曼德启动港股招股,拟9月1日挂牌。其为机器人提供眼脑手组件,2025年全球市占率第一。业务增长快、海外收入过半,获豪华基石阵容认购,超八成募资将投向研发等。

甲子光年
开源动态8

刚刚,国产AI自己造了AI,全球首例!

面壁智能实现全球首例国产AI造AI,用AI编写预训练框架ForgeTrain,性能超英伟达Megatron,还训练出MiniCPM5 - 1B模型。该模型可作桌宠,小尺寸高智能,还能自定义人格,提供工具链。

量子位
新闻资讯8

微软发布5大AI Agent模式:一键解锁AI员工,打造智能体工厂

今天凌晨微软官网发布5种常用Agent模式助用户开发自动化AI员工。智能体比传统自动化工具更具优势,能推理协作等。各模式都有应用案例,且Azure AI Foundry支持多Agent模式开发。

AIGC开放社区
新闻资讯7

亿点点新融资砸向具身智能:斯坦福华人团队,首创“自适应机器人”品类

具身智能火热,非夕科技完成C轮亿级美元融资,由咏归基金、广发信德联合领投。该公司由斯坦福大学相关成员创立,首创“自适应机器人”品类,此轮资金用于扩产、研发及生态拓展。

量子位
8

UI-TARS-desktop:字节跳动的原生GUI智能体,用自然语言控制电脑和浏览器

字节跳动开源的UI-TARS-desktop是原生桌面GUI智能体工具,基于UI-TARS和Seed-1.5-VL系列模型。能用自然语言操控电脑和浏览器,有本地和远程两种模式,支持多平台,还对比了同类工具。

小华同学ai
算法论文8

OpenClaw代码越改越崩?新研究EvoClaw揭示:Agents持续开发成功率仅13.37%

USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。

量子位
新闻资讯7

数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免

研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。

量子位