「文本token」共找到 1063 篇相关文章
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
黄仁勋暴论核弹:AGI已经实现,Ilya错了,程序员有10亿
在Lex Fridman的专访中,黄仁勋抛出诸多惊人观点,如称已实现AGI,反驳Ilya“预训练触顶”言论,认为推理计算难且重要,还对未来技术、行业、职业发展等多方面进行展望。
中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力
大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。
谷歌发布首个AI+教育RCT实验,传统教材要凉?
谷歌论文提出Learn Your Way AI增强型教科书系统,有两阶段AI生成框架,构建完整学习体验。经专家评审和RCT证明,使用该系统的学生学习效果和体验更好,还介绍了其可用场景。
1人顶1个Infra团队!OpenAI前CTO新招,让大模型训练跌成白菜价
大模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。
AI视频生成平台
酷模Cumob AI是基于Next.js构建的AI内容生成平台,集成多AI服务提供商API,有漫画生成等工作流,具备并发处理、资源管理等优化,支持多种部署,有诸多功能特性与亮点。
开源3天斩获 2K Star,这个开源 Skills 技能把 AI 的“记忆缺陷”补上了!
最近含金量极高的 Skills 指南 planning-with-files 开源上线 3 天,GitHub Star 达 2k。它复刻 Manus AI 核心模式,将 Markdown 作为 AI Agent 工作内存,采用三文件模式解决 AI 记忆问题。
装了 AI 大脑的 Grep
本文介绍了 mgrep 工具,它有自然语言搜索、支持多语言多模态等特点。还说明了使用方法,如安装、登录、索引项目和搜索等,能与编码 Agent 配合,可补充 grep 进行代码搜索。
Multi-Agent记忆系统MIRIX:比RAG性能飙升35%,存储减少99.9%
现有AI Agent记忆方案有局限,MIRIX作为模块化多智能体记忆系统应运而生。它由六种记忆类型和多智能体框架组成,支持多种检索功能。在多模态和单模态测试中表现优异,为记忆增强型LLM智能体设新标准。
一个月重写三次代码库、三个月就换套写法!吴恩达:AI创业拼的是速度,代码不重要
吴恩达在 Y Combinator 演讲分享创业心得,指出 AI 创业成败关键在执行速度,最大机会在应用层,还介绍提速方法,如想法具体、用 AI 编程工具等,问答中回应 AGI 炒作等问题。