代码强化学习」共找到 2984 篇相关文章

推荐文章8

一文带你彻底搞懂!企业级MCP Server接入OAuth授权服务器全流程解析(含完整代码

文章从基础概念入手,借Python + MCP SDK + 第三方授权示例,解析企业级MCP Server接入OAuth授权服务器全流程,包含OAuth 2.0概念、MCP支持架构、Google OAuth2.0认证实战及与其他安全方案配合。

AI大模型应用实践
开源动态8

卡帕西630行代码炸出81个智能体,4天协作跑2333次实验,公布预训练十大发现

Karpathy的Autoresearch项目630行代码让AI自主实验,提升语言模型训练效率。全球开发者让多智能体协作,智能体自发形成同行评审制度。项目发起者公布十大发现,还衍生出表现出色的auto - discovery项目。

量子位
新闻资讯7

AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?

Anthropic 公布全新 Skills 功能,让开发者可通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明可审计,受开发者称赞。

InfoQ
算法论文8

监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力

大模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。

量子位
算法论文8

深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析

近日,清华等多机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。

AI科技评论
开源动态8

GitHub 8k star!AI Gateway 如何帮你3行代码接入1600+ LLM,实现成本、可靠性与安全三赢?

Portkey AI Gateway是面向生产环境的开源AI Gateway,支持超1600款模型,通过1个API接口实现快速、可靠、安全的模型路由。它能解决产品开发和使用中的痛点,有统一API接口等核心功能。

小华同学ai
8

技术框架不重要,大厂简历不值钱?小哥不会写代码却进了Lovable,80% 靠聊天也能上生产

Lovable是当红AI产品公司,估值66亿美元,其开设全职Vibe Coder岗位。零技术背景的Lazar Jovanovic成首位该岗员工,他80%时间规划对话,介绍了Vibe Coding方法及应对问题策略,强调表达、品味等重要性。

InfoQ
开源动态8

Karpathy最新手搓!复现GPT-2成本狂降600倍:仅需507元3小时训练「最好的AI学习项目」

Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成本低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成本降600倍,还列出关键优化技术,设排行榜。

AI寒武纪
算法论文8

让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍

香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能