有监督学习」共找到 7106 篇相关文章

产品应用8

终于AI视频模型,解决了体操难题。

前天深夜MiniMax发布Hailuo 02视频模型,虽未正式上线但放了预告片。该模型能生成杂技动作,解决了体操难题,在复杂动作肢体表现上吊打其他模型,还支持原生1080P,价格便宜。

数字生命卡兹克
新闻资讯7

ChatGPT引爆教育革命,学习效果暴涨86.7%!

新智元报道,Nature子刊元分析汇总51项研究,揭示ChatGPT显著提升中小学生学业表现和高阶思维能力,不限学科和使用方式,还能减轻精神负担,但使用需家长和老师指导。

新智元
新闻资讯7

山姆•奥特曼:ChatGPT 用户三层代沟

OpenAI的CEO山姆•奥特曼在红杉闭门演讲中透露,不同年龄层使用ChatGPT方式不同,老年人当谷歌替代品,二三十岁的人当生活顾问,大学生当操作系统,这反映了AI与人类交互模式的转变。

AGI Hunt
产品应用8

Kimi新出的Agent集群,到底多恐怖?

Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,多项评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。

newtype AI
算法论文7

OpenAI谈:大模型为什么会幻觉?如何避免?

OpenAI论文探讨大模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练和后训练阶段剖析根源,提议改造评测,引入置信度阈值和错误惩罚机制。

探索AGI
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法效性和可扩展性。

机器之心
推荐文章7

sglang 源码学习笔记(二)- backend & forward 过程

本文深入解析sglang forward核心实现全流程,介绍了forward传递过程、AttentionBackend数据结构,以flashinfer为例展开分析,还说明了cudaGraphRunner初始化、Capture、Replay过程,助读者理解代码。

GiantPandaLLM
推荐文章8

大模型Agent的核心还是prompt? 目前什么挑战?

文章指出大模型Agent核心并非Prompt,而是工程化架构设计、工作流编排与数据闭环。介绍Flow Engineering等概念及工具,分析规划、记忆、工具使用要点,还谈及开发面临的延迟、稳定等挑战,并给出应对建议。

深度学习自然语言处理
新闻资讯7

给 Agent 接搜索功能,哪些「坑」需要特别注意?

搜索是AI产品标配,但给AI接搜索不易,给人用和给AI用的搜索差异大。信息检索质量影响Agent推理与任务完成度。邀请小宿科技相关人员聊给Agent接入搜索能力,10月30日20点线上闭门活动可扫码报名。

Founder Park
新闻资讯7

Karpathy 教它的 nanochat 数单词里几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但效,不过小模型上下文处理能力限。

AI工程化