「小样本学习」共找到 2428 篇相关文章
2 亿美元 ARR,AI 语音赛道最会赚钱的公司,ElevenLabs 如何做到快速增长?
AI音频独角兽ElevenLabs估值66亿美元,从“小公司”成长为独角兽。其CEO回顾创业历程,分享心得,如结合研发与产品、融资绑定产品动态、靠三点优势不被OpenAI取代等,还谈及人才、融资、业务等方面策略。
OpenAI总裁透露GPT-5改了推理范式,AGI实现要靠现实反馈
OpenAI总裁Greg Brockman在访谈中透露AGI之路,包括技术上转向强化学习推理范式,资源上持续投入计算资源,落地时封装成Agent。还提到GPT - 5改变推理范式,强调计算对AGI的重要性及模型落地等内容。
GPT-5.6 Sol首批内测结果来了!同任务成本只有Fable 5一半
GPT-5.6 Sol预览版发布半月,首批内测报告出炉。它代码简洁,适合长链路任务,视觉效果好。虽整体略逊Fable 5,但成本近乎减半,且安全限制小,即将全量上线。
逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%
Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。
梁文锋执笔的R1论文登上Nature封面!首次回应外界三大质疑
9月17日,DeepSeek创始人梁文锋通讯作者名义发表的DeepSeek - R1论文登《自然》封面。该模型借助强化学习自主形成推理能力,在Hugging Face下载量破1090万次。新版论文回应质疑,披露训练细节,虽有不足但引发学界关注。
1.93bit版DeepSeek-R1编程超过Claude 4 Sonnet,不用GPU也能运行
1.93bit量化后的DeepSeek - R1(0528)编程能力超Claude 4 Sonnet,在aider榜单获60分。Unsloth工作室制作9个量化版本,小版本不用GPU也能跑。R1 - 0528在游戏评测中表现也佳。
清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理能力
清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。
AI应用如何落地政企?首先不要卷通用大模型
ISC.AI 2025大会显示智能体技术加速渗透产业。360政企AI业务与智能体深度绑定,其落地有三重逻辑:不追通用大模型,聚焦小场景;用“乐高式”工厂赋能;安全与AI深度融合是必选项。
斯坦福「返老还童」新研究:无需干细胞,逆转关节损伤和老化
斯坦福医学院新研究聚焦关节,不依赖干细胞和置换手术,通过口服或注射药物实现软骨再生。实验表明,抑制15 - PGDH酶可提升前列腺素E2水平,逆转老年动物软骨流失,还在人类样本上验证了药物作用。
142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要
文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。