强化学习系统」共找到 2987 篇相关文章

算法论文8

仅需一个混频器的无线射频机器学习推理,登上Science Advances!

杜克大学和MIT教授团队提出广播模型并在射频上完成计算的分离式计算方案,在边缘端混频器模拟计算中完成推理,解决传统方案问题,还在测试平台验证,能耗低且能完成多项机器学习任务。

机器之心
算法论文7

首篇,系统盘点扩散模型高危漏洞!看懂攻击方式和防御体系

随着扩散模型广泛应用,其安全问题凸显。天津大学团队论文系统梳理文生图模型攻击方式、风险类型、威胁场景与防御体系,指出当前防御不足,需建立更体系化防护体系。

新智元
新闻资讯7

17000 tokens的GPT-5系统提示词被意外泄露,以及八点总结~

OpenAI GPT - 5的system prompt被曝光在github,约17803 Tokens、78960 Characters。文章对提示词做八点分析总结,如互动风格、写作要求、工具使用等,还给出工具部分重点。

PaperAgent
新闻资讯7

马斯克造星链,劈柴造算链!英伟达卷到宇宙,谷歌也要上天

谷歌官宣「Project Suncatcher」,要在太空建设可扩展的AI计算系统,预计2027年发射两颗原型卫星。此系统利用太阳能驱动AI,由卫星星座构成,但面临打造星间链路、控制卫星编队等挑战。

新智元
8

跳出超级 App 之争,鸿蒙系统级智能如何改写 AI 赛道规则?

2025年AI热潮转向落地场景深耕,华为鸿蒙在终端操作系统层面开辟新赛道。其通过鸿蒙智能体框架打破‘APP孤岛’,走‘C+B’差异化路线,还推出开放平台等繁荣生态,推动终端智能化迈进。

AI科技大本营
产品应用7

为 OpenAI 秘密提供模型测试, OpenRouter 给 LLMs 做了套“网关系统

OpenRouter成立于2023年初,为用户提供统一API Key调用各类模型,OpenAI会用其秘密测试。平台token用量高速增长,还发布模型用量排行榜引关注。创始人认为大模型非赢家通吃,未来想成agent最佳推理层。

海外独角兽
产品应用7

3 个 Multi-Agent 系统,把 GPTBots 的多智能体协作玩明白了!

文章介绍如何在GPTBots平台玩转多智能体系统,阐述多智能体协作优势、架构及三种协作模式,通过旅游规划、辩论对抗、商业决策三个案例展示协作模式应用,还给出总结与进阶建议。

PaperAgent
算法论文8

大模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
算法论文7

Thinking Machines曝LoRA终极指南:10倍学习率,媲美全参微调

Thinking Machines推出论文《LoRA Without Regret》,研究LoRA与FullFT达到相近表现的条件。通过实验发现,把握关键细节,LoRA可与FullFT性能相当,还探讨了关键因素、批大小效应等内容。

新智元
算法论文8

Nature重磅:AI和人脑的根本区别找到了,我们对“聪明”的理解可能全错了

2025年《自然·机器智能》研究指出AI和人类在‘泛化能力’上本质不同。人类泛化靠抽象,学习高效;AI泛化靠统计,学习笨重。未来AI与人应互补协作,而非谁取代谁。

AIGC开放社区