小样本学习」共找到 2430 篇相关文章

新闻资讯7

5个月内失败十几次,几人团队在压力下做出爆款App!网友:AI时代懂人性比懂技术更重要

社交应用 Candle 上线六个月用户超 30 万,月营收超 15 万美元。其创始人曾开发 Encore 未成功,后经多次试错,受人际关系问题启发打造该应用,旨在维护亲密关系,不过也面临用户留存和功能体验挑战。

AI前线
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
推荐文章7

CuteDSL-1: Introduction

文章介绍CuteDSL,它因Cutlass编译慢、调试难等痛点而生,可在Python构建DSL,编译快、调试易且性能无损。文中阐述其架构、使用方法、与PyTorch集成优势等,还提及基于CuTe的开发及性能对比。

GiantPandaLLM
7

Agentic Enterprise:生成式软件重新定义企业形态|AGIX PM Notes

文章指出软件正从静态代码集合变为“Living Software”,企业是其理想训练环境。还提及市场资金流向、多起企业投资合作事件,如英伟达投资英特尔、OpenAI租服务器等,最后介绍了ETF流动性相关知识。

海外独角兽
算法论文8

谁说Scaling Law到头了?新研究:每一步的微提升会带来指数级增长

很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但新研究发现,模型单步准确率的微提升能使完成任务长度指数级增长,还探讨了长程执行能力的衡量及影响因素。

机器之心
新闻资讯7

DeepSeek新模型意外曝光:AI Agent才是未来~

据彭博社消息,中国AI新星DeepSeek计划年底发布对标OpenAI的AI Agent,能自主执行多步任务、自我学习进化。国内Kimi、Qwen也有相关动作,还分享了72多种高效AI工具。

PaperAgent
新闻资讯7

The Batch: 871 | Mistral测量了大语言模型的能耗、水耗与物料消耗

法国AI公司Mistral发布对Mistral Large 2的环境分析报告,涵盖全生命周期影响。研究表明单次使用影响,但累计负担大。虽研究有不足,但其方法或推动环保型AI发展。

DeeplearningAI
新闻资讯7

Meta和Scale AI闹翻!砸143亿买的高管跑路,业务也合作不下去

两个多月前,Meta豪掷143亿美元收购Scale AI 49%股份,如今双方在团队融合、业务合作方面产生纠葛。原Scale AI高管离职,Meta研究人员抱怨其数据质量低。双方后续发展不尽如人意。

量子位
算法论文8

推理能力再突破!蚂蚁 | 提出Agentic Deep Research新范式,可信度同步增加

尽管LLM能力提升,但复杂任务表现受静态知识限制。业界提出Agentic Deep Research系统,现存系统训练有梯度冲突和奖励稀疏问题。蚂蚁团队提出Atom - Searcher,创新推理范式,构建细粒度奖励,结合奖励训练,实验效果佳。

AINLPer
算法论文8

让AI作画自己纠错!随机丢模块就能提升生成质量,告别塑料感废片

来自清华、阿里等的团队推出S² - Guidance方法,通过随机丢弃网络模块动态构建子网络实现自我修正。它避免了其他方法繁琐调参,在文生图和文生视频任务中显著提升生成质量与连贯性,且计算高效。

量子位