学习型集成」共找到 1945 篇相关文章

算法论文8

一个标点就能迷惑LLM-as-a-Judge!

论文揭露惊人漏洞,一个标点或通用推理开场白就能欺骗最先进的LLM裁判,导致强化学习训练崩溃。研究通过实验验证漏洞,提出Master - RM模,其FPR近乎0%且保持通用裁判能力。

深度学习自然语言处理
新闻资讯7

清华计算机女神,冲刺IPO了

清华计算机系女神庄莉创办的镁佳科技,完成招股书提交,开启IPO冲刺,目标港交所主板上市。镁佳主打智能座舱集成式域控解决方案,虽业务增长,但面临竞争挑战,2024年营收14亿、亏损2.9亿。

量子位
算法论文7

一文解读 LLM Posting-Train技术

文章解读了大语言模后训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。

海边的拾遗者
新闻资讯8

DeepMind 创始人 Hassabis 语出惊人:百万 token 只是在贴胶带,AGI 在 2030 年

DeepMind创始人Hassabis在访谈中评估AGI进展,认为当前范式是最终架构一部分,但持续学习等问题待解决,预计2030年左右实现AGI,还探讨了Agent、蒸馏等多方面内容,并给创业者建议。

MacTalk
算法论文8

DeepMind再登Nature:AI Agent造出了最强RL算法!

Google DeepMind团队提出DiscoRL,让智能体在多环境交互中自主发现强化学习规则,无需人类设计。它在Atari基准中击败MuZero,在未见过的游戏中也稳定高效,相关研究登《Nature》。

新智元
算法论文8

MIT发布自适应语言模!新任务,自生成远超「GPT-4.1合成训练数据」

麻省理工学院提出自适应语言模框架SEAL,让大模生成微调数据和更新指令适应新任务。实验显示,其生成的合成数据微调效果超GPT - 4.1,在少样本学习和知识整合任务表现优异。

新智元
开源动态8

AI驱动的开源攻击框架:HexStrike-AI

HexStrike-AI是安全研究员开发的开源攻击框架,2025年7月起在GitHub免费提供。它基于MCP协议,集成LLM与150多种工具,可自动化渗透测试和漏洞发现。曾被网络犯罪分子利用,能加速攻击流程,展现强适应和并行化能力。

AI与安全
产品应用8

YOLO + OpenClaw 缺陷检测智能体,低代码实战方案

文章介绍了YOLO + OpenClaw缺陷检测智能体低代码实战方案。先指出实时检测延迟问题,提出离线自动化方案。接着讲训练YOLO模、创建OpenClaw技能、配置自动化任务及企业微信集成,还对比了与人工质检效果。

机器学习AI算法工程
产品应用8

PolarDB Supabase 助力 Qoder、Cursor、Bolt.diy 完成 VibeCoding 最后一公里

Vibecoding是开发者追寻的理想境界,但常被各种‘摩擦力’打断。PolarDB Supabase提供‘零摩擦’后端基础,通过MCP Server填平前后端断层,还能与Qoder、bolt.diy集成,提升开发效率,文末介绍其构建图数据分析应用方案。

阿里云开发者
新闻资讯7

首个为手机而生的通用 Agent?!苹果做不到的事,“野路子”智谱抢先实现了

苹果预计 2026 年升级 Siri 实现自主行动,但完整落地的执行 Agent 未推出。8 月 20 日智谱发布 AutoGLM 2.0,称是全球首个可在手机用的 Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。

InfoQ