「AI智能体推理框架」共找到 11964 篇相关文章
华尔街彻夜难眠!Gemini 3屠榜金融「最难考试」,AI砸了「金饭碗」?
被誉为「黄金职业通行证」的CFA考试被AI攻陷,推理模型不仅全部通过三级考试,部分科目接近满分。如Gemini 3.0 Pro在一级考试创97.6%最高纪录。不过AI仍有局限,还不能完全替代分析师。
空间智能第一股,开盘暴涨171%!李飞飞押注的赛道,杭州六小龙之一跑通了
今日,群核科技(00068.HK)正式挂牌上市,报20.70港元,较发行价上涨171.65%。空间智能被视为AI的下半场,群核科技是该赛道首个跑通商业化闭环的公司,其优势在于数据、模型和飞轮。
神隐许久的光年之外,造了款AI浏览器Tabbit,能打吗?
浏览器成AI落地重要战场,巨头纷纷布局。光年之外推出Tabbit AI浏览器,集多种功能于一体,深度融合AI能力,已开启公测。实测其功能实用,虽有不足但已改变使用习惯,AI浏览器或重塑人与信息关系。
GPT-5.5全球首破!0源码盲写程序,编程AI进入新纪元
全网AI交白卷的ProgramBench编程基准,被GPT-5.5首破。它能0源码盲写程序,同一题用C和Python两种解法通过测试。相比之下,Opus 4.7表现不佳。这揭示推理算力成编程AI核心变量。
Claude Code 的创始人揭秘工作流程:开 5 个智能体“玩编程游戏”,不看的程序员就落后了?
Anthropic公司Claude Code创始人Boris Cherny在社交平台分享工作流程,引发行业关注。他并行运行5个Claude智能体编程,用最大最慢模型Opus 4.5,还解决AI“健忘症”,实现重复性任务自动化。
想清楚再动手:具身智能也要学会脑补未来和择优执行 | RSS 2025
近年来基础模型在具身智能领域能力惊人,但在真实部署中常‘用不好’。卡耐基梅隆大学与伯克利人工智能研究院团队提出 FOREWARN 框架,结合‘世界模型’与‘多模态语言推理’,解决部署智能难题。
智能体「卷王」诞生!干活自动配结项报告,1.5张截图就把事说清了
在LLM/VLM驱动的智能体强化学习研究中,验证完成度是挑战。为此提出SmartSnap方法,让智能体成“质检员”,主动留痕存证。它有三大突破,表现惊艳,简化训练准备,让AI更可靠。
OpenClaw 能“边用边训”了:智能体强化学习训练框架 AReaL v1.0 稳定版发布
3月4日,蚂蚁集团联合清华发布开源强化学习训练框架AReaL v1.0稳定版,主打‘Agent一键接入RL训练’。它解决现有智能体框架接入训练成本高、缺乏持续进化能力的问题,还推出原生训练引擎Archon,集成AI辅助开发体系。
金融AI的年度大考交卷了:2万名选手、30+家机构、百亿级数据开源
八月末上海举办的AFAC金融智能创新大赛(AFAC2026)总决赛,吸引众多顶尖选手。赛题模拟真实金融场景,涵盖数据规模、反馈少等难题。四届赛题反映金融AI技术迁徙,还开源百万金融智能数据集,构建数据飞轮。
1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿
上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。