金融研究智能体」共找到 5063 篇相关文章

算法论文8

真实联网搜索Agent,7B媲美满血R1,华为盘古DeepDiver给出开域信息获取新解法

华为诺亚方舟实验室提出 Pangu DeepDiver 模型,实现 LLM 搜索引擎自主交互新范式。它用真实互联网数据训练,在 WebPuzzle 等基准测试中,7B 的 DeepDiver 媲美 671B DeepSeek - R1,展现强大信息获取与泛化能力。

机器之心
新闻资讯7

直播预约 | 推理模型的“过思考”现象与高效推理,2.5h的深度分享

本期GenTalk学术分享邀请刘梓辰、齐朋辉等4位博士生,在2025年6月6日15:00 - 17:30带来“推理模型的‘过思考’现象与高效推理”报告,由夏鹤明主持,NICE学术等支持。将分析‘过思考’因素,总结高效推理思路。

深度学习自然语言处理
算法论文8

开源模型竟被用于窃取下游微调数据?清华团队揭秘开源微调范式新型隐藏安全风险

清华、墨尔本大学团队研究指出,基于开源模型微调专有模型存在新型隐藏安全风险,开源模型发布者可埋后门窃取下游微调数据,新风险难检测、危害大,目前攻防方法待改进。

机器之心
新闻资讯8

谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?

北京时间5月21日凌晨,谷歌在I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和更好的2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3等,编码助手Jules公测。

InfoQ
算法论文8

GPT-4V仅达Level-2?全球首个多模态通才段位排行榜发布,General-Level打造多模态通用AI评测新范式

General-Level团队提出全新评测框架General-Level和数据集General-Bench,构建超大规模评测基准和多模态通才模型排行榜。其用五级段位体系衡量模型通才能力,General-Bench覆盖多模态任务,排行榜分多层次榜单,目前各模型段位差异大,Level-5空缺。

量子位
产品应用7

200K上下文突破:AI编程新星Augment崛起

AI编程新星Augment以65.4%的SWE - bench评分登顶榜首,估值超128亿美元。它能理解海量代码上下文,支持多环境集成。但新式AI编程工具存在安全风险,如Agent Memory恶意攻击等,文中给出应对建议。

腾讯技术工程
新闻资讯8

拒绝OpenAI和Anthropic邀约,DeepMind安全研究员离职转向独立测评

本文报道,多名头部AI机构研究员因AI安全顾虑离职,DeepMind AGI安全研究员Engels拒绝OpenAI、Anthropic邀约,加入独立评测机构METR,围绕AI递归自我改进失控风险展开讨论。

DeepTech深科技
推荐文章8

Meshy 胡渊鸣:GPT-6 Astra 能做 3D 之后,3D 生成产品的价值在哪里?

Meshy创始人胡渊鸣针对GPT-6 Astra具备3D生成能力一事,拆解其能力边界,分析其对专业3D生成行业的影响,给出自身判断,并为图形学研究者提供方向建议。

Founder Park
开源动态8

牛B, 我真的起飞啦,6.4k Star Bright Data CLI~~~~

约6.4k Star的Bright Data CLI想解决AI Agent访问网页难题,把网页变成易被模型读懂的材料。它将网页访问能力拆成终端可组合动作,还关注工程化细节,让Agent上网有章可循。

小华同学ai
推荐文章8

“大脑在硅谷,身体全靠中国!”机器人泰斗揭秘真相:后空翻只是杂耍,端起咖啡才是真AI

在最新一期播客中,机器人学泰斗 Sergey Levine 与 Ryan Peterman 深度对话,触及行业焦点如机器人发展阶段、波士顿动力淡出原因等。他强调,机器人技术尚处底层搭建期,需重视先验知识、软硬件结合,跨越鲁棒性门槛。

AI科技大本营