「小样本学习」共找到 2428 篇相关文章
Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16
Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。
AI花17小时写了篇30页学术论文!自主选题,包含实验,还符合APA格式规范
Virtuous Machines AI系统花17小时、114美元,找288个真人做实验,写了篇30页认知心理学领域学术论文,从选题到成稿全自动化。其架构独特,不过也存在理论误解等小缺点。
AI产品能不能火,全看创始人会不会当“网红”?这届AI大佬不拼代码了,个个都是隐藏的社交媒体达人
今年,AI创业者热衷在小红书冷启动产品,创始人分享创业思考,团队招募伙伴,投资人找项目。AI产品成功离不开社交传播,如Lovable、Base44等。但传播不能牺牲产品质量和技术壁垒,创业公司应抓住时间差深耕场景。
马斯克机器人出街卖爆米花,还会捉弄顾客
马斯克的特斯拉Optimus机器人出街卖爆米花,还会捉弄顾客、给小朋友递爆米花、拍照比剪刀手。它是全黑款,此前还曝出金色款,且开通中国区微博。此外,小鹏首款机器人‘Iron’亮相慕尼黑车展。
对话心资本吴炳见:我不问AI创业的“终局”|甲子光年
本文是对心资本合伙人吴炳见的访谈。他2022年底All in AI,分享投资理念,如共鸣时投资、关注当下问题;分析AI发展阶段、应用情况,认为Agent是核心应用形态;还谈及投资案例、学习方式及经验复用与摒弃等。
ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测
北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。
无需外部数据!AI自问自答实现推理能力进化
卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。
OpenAI新模型,被曝秘密训练中!万字硬核长文直指o4核心秘密
SemiAnalysis爆料,OpenAI正训练规模介于GPT - 4.1和GPT - 4.5间的新模型,下一代推理模型o4基于GPT - 4.1训练。强化学习成推理模型进步功臣,但面临基础设施瓶颈,奖励函数难定等问题。
从操作系统到Agent Team,字节Seed 2.0来了!
作者受字节内测邀请,对豆包大模型Seed 2.0进行多方面测试。在APP开发、多模态理解、操作系统构建、Skills调用、真实项目开发等测试中表现出色,虽有小缺点,但整体提升大,值得试用。
大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%
上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。