「零样本分类」共找到 606 篇相关文章
AST | 西工大马龙、邬晓敬等:几何特征知识驱动的代理优化方法
机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。
EMNLP2025 | SFT与RL的结合,vivo AI Lab提出新的后训练方法
vivo AI Lab 算法团队提出新的大模型后训练框架 GTA,综合 SFT 和 RL 优点,解决文本分类场景中 RL 收敛慢问题。论文已被 EMNLP 2025 录用,介绍了 GTA 框架设计思路、实验结果等,未来还将探索更多场景和大模型。
AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法
在AI驱动的数据应用场景中,Kafka、Iceberg开放表格式与对象存储组合成流数据入湖重要方向。传统ETL方式有链路长等问题,文章围绕“零ETL”讨论架构减法,介绍Kafka × Table Bucket方案及优势、适用场景。
独家|能量桥完成新⼀轮融资,Monolith领投,中科创星跟投
近日,能量桥完成新一轮融资,由 Monolith 砺思资本领投,中科创星跟投。该公司核心团队经验丰富,其预制化超导能源模块可实现数据中心配电零损耗。在 AI 算力建设背景下,超导技术或成输电破局点。
微信悄悄上线AI播客,新闻主播们的活儿可能真要被抢了。
微信正在灰度内测AI播客,入口在“快讯”页面。它从重要新闻中挑内容分类改写,以双人对话方式播读。此前公众号后台也尝试AI声音。此功能适合资讯新闻,未来或能盘活更多信息场景。
NIPS 2025 Spotlight | 港大提出TreeSynth方法,一句话生成百万规模数据集
港大团队提出TreeSynth方法,受决策树启发,将数据合成问题映射到其空间分割机制。它采用两阶段流程,能从零合成数据,还可优化现有数据集。实验显示其在多基准任务上性能提升显著,可扩展性佳。
仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架
阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进化生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进化新路径。
陶哲轩:AI 已经把想法成本降到几乎为0了...
著名数学家陶哲轩在与播客主持人Dwarkesh Patel的对谈中分享使用AI一年后的观点,认为AI已将想法生成成本降至几乎为零,但验证和评估成新瓶颈,还探讨其对数学研究的影响及未来发展。
少说‘Wait’,多做题:NoWait重塑大模型推理路径
现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。
2026年最火的AI机遇,为什么是「OPC」?
2025年末北京颁发首个OPC服务计划,中关村AI北纬社区打造OPC先行示范高地。OPC以一人带AI Agent跑通公司全流程,2026年将因边际成本崩塌、交互范式转移而爆发,文中还拆解5个顶级OPC样本并给出工具栈。