有监督学习」共找到 7102 篇相关文章

算法论文8

AI在线强化学习“边做边学”,斯坦福团队让7B小模型性能飙升,甚至超越GPT-4o

斯坦福等团队提出新范式AgentFlow,由四个智能体组成,用在线强化学习持续提升智能体系统推理能力。以Qwen - 2.5 - 7B - Instruct为基座模型的它在多基准测试表现突出,甚至超越GPT - 4o等大模型。

量子位
算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合自编码器

本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。

力学与人工智能
算法论文8

联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散自回归生成方法重焕生机,轻松渲染长文本图像

图像生成领域,自回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升自回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。

机器之心
推荐文章7

一文探析多分类指标Accuracy/Precision/Recall/F1-score

文章探讨机器学习分类模型评价指标,指出Accuracy在不平衡数据集缺陷,需引入Precision、Recall和F1 - score。分开解析二分类和多分类模型指标,还给出不同场景下指标侧重建议。

海边的拾遗者
新闻资讯8

被员工怒怼“磕了”,追觅CEO:我肚量;AI恋人陪聊涉黄被判刑,2.4万人付费;马斯克、奥特曼又开撕|AI周报

本周AI热点众多,AI恋人陪聊涉黄案二审,追觅CEO回应员工怒怼,携程涉垄断被查等行业事件;还文心大模型5.0登顶国内文本榜、字节跳动发布SeedFold等大模型进展;以及苹果、谷歌等企业的应用合作动态。

AI前线
算法论文8

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。

机器之心
新闻资讯8

智源悟界·Emu3.5发布,开启“下一个状态预测”!王仲远:或开启第三个 Scaling 范式

2025年智源发布悟界·Emu3.5,在“Next-Token Prediction”基础上实现“Next-State Prediction”。它能力全面提升,或开启第三个Scaling范式,还在预训练、强化学习、推理加速上技术创新。

AI前线
新闻资讯8

换掉小龙虾!Hermes全网爆火狂揽四万星,Anthropic重锤暴击OpenClaw

近期两大AI新物种冲击OpenClaw。Anthropic上线的Managed Agents实现大脑与执行环境分离,降维打击效果;Hermes Agent开源且在GitHub揽4万星,学习闭环,让OpenClaw显得过时。

新智元
产品应用7

Hermes 登顶 OpenRouter 之后,我才发现它最缺的那一块,被这个插件补上了

Hermes Agent 三个月登顶 OpenRouter,虽好用但记忆处理缺陷,记忆库成大杂烩。记忆张量的 MemOS Local Plugin 2.0 可解决此问题,采用‘执行即学习’,双层反馈机制,且资产可携带。

AI工程化
新闻资讯7

Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用大模型气得我自己写代码都劲儿了

Redis之父Antirez分享开发经历称人类程序员仍比大模型出色,举例说明在解决Redis复杂bug时,人类的创造力能想出奇特效的解法,而大模型较难做到。开发者看法不一,将其当助手,也认为它会干扰思路。

InfoQ