少样本训练」共找到 2463 篇相关文章

新闻资讯7

Karpathy揭秘开源成功密码:像细菌一样写代码

Andrej Karpathy提出构建繁荣开源社区要像细菌写基因组一样写代码,强调代码小巧、模块化、自给自足。他指出此方式有局限,应兼顾细菌与真核生物基因组优点,还称“More gists, less gits!”。

AGI Hunt
算法论文8

ICLR最佳论文:Transformer天生简洁

2026年ICLR最佳论文对Transformer做深度思维体检,指出其架构真正威力在于描述概念时比RNN等简洁指数级甚至双重指数级,但验证其内部逻辑计算成本高昂,为解释其能力开新窗。

AIGC开放社区
算法论文8

ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成

清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。

机器之心
产品应用7

OpenClaw 2个月超越Linux,但企业没人敢用。终于有人来填这个坑了。

OpenClaw火了,2个月GitHub星标超Linux,个人用户玩得欢,但企业不敢用。MemTensor团队的ClawForce来填坑,它能自动配置,复刻打法,有管控审计,助力OpenClaw走向企业化。

探索AGI
开源动态8

彻底告别VE与VAE!商汤硬核重构多模态:砍掉所有中间编码器

商汤科技联合南洋理工大学发布NEO - unify,这是“原生、统一、端到端”多模态模型架构,砍掉VE和VAE,用混合变换器架构打通视觉与语言能力,提升数据与算力利用效率,为跨模态智能系统奠基。

量子位
算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
算法论文8

多模态BUG修复新SOTA:慕尼黑工大GUIRepair登上SWE-bench Multimodal榜单第一

自动化修复软件缺陷是长期目标,多模态问题修复受关注。慕尼黑工业大学团队提出GUIRepair,融合APR与GUI Testing知识,登上SWE - bench Multimodal榜单第一,为多模态软件自动修复开辟新路。

机器之心
新闻资讯7

网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能

网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。

InfoQ
新闻资讯8

苏妈和李飞飞炸场CES!AMD AI全栈野心显露:从云端到个人PC,AI芯片性能四年要飙1000倍

今年 CES 上 AMD 专场演讲亮点多。苏姿丰称未来五年50亿人每天用 AI;李飞飞和她探讨空间智能与世界模型;Helios 平台受关注,MI455 GPU 解决内存墙;Ryzen AI 推动 AI 下放到本地。

AI前线
算法论文7

ImageNet分数越高,生成反而越糊?iREPA给出解释

Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。

新智元