「类R1训练」共找到 2527 篇相关文章
2M大小模型定义表格理解极限,清华大学崔鹏团队开源LimiX-2M
大语言模型在结构化表格数据处理上表现不佳,清华大学崔鹏团队开源的 LimiX-2M 模型,仅 2M 参数,却能同时支持分类、回归等任务,性能超越经典模型,且训练、运行成本低,科研友好。
被轻视的巨大市场,大厂做不好的Local Agent为何难?| 甲子光年
文章指出大模型边际收益递减,AI竞赛规则生变,产业从‘参数竞赛’转向‘效率革命’。本地Agent有潜力,但主流产品体验差。GreenBitAI深耕低比特模型,推出Libra,有望撬开万亿美元增量市场。
BigBang-Proton: 自回归基座模型统一语言、科学和物质世界
超对称公司发布新版基座模型 BigBang - Proton,实现多学科问题与 LLM 统一预训练和推理,挑战主流 AGI 技术路线。它有三项创新,在多专业学科任务表现出色,还提出宇宙尺度压缩构想。
达摩院推出多智能体框架ReasonMed,打造医学推理数据生成新范式
在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级高质量数据集ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。
综述连arXiv都不给发了?最严新规出台:被会议、期刊接收才行,workshop都不行
arXiv出台新规,计算机科学分类下综述和立场论文须先被正式期刊或会议接收且完成同行评审,投稿时要提供证据。因此类文章数量多、质量差,新规引发热议,有人认为太严。
张小珺对话李想:3小时长谈总结(AI、VLA与组织进化)
张小珺半年前与李想3小时长谈,围绕AI展开多话题探讨。李想认为AI应成生产工具,赞赏DeepSeek,还分享VLA架构、理想终局规划,提出管理心法,思考AI与人关系。
美团杀入视频生成模型赛道,LongCat-Video 136亿参数媲美顶尖模型,效率提升10倍
美团LongCat团队发布LongCat - Video基础视频生成模型,有136亿参数量,多任务表现出色。它核心亮点多,还建立了数据处理流水线,采用特殊架构和训练方法,提升了生成效率,性能媲美顶尖模型。
P图老本事搭上了对话框,美图这AI Agent到底香不香?
本文对美图AI Agent RoboNeo进行实测。它web端操作简单,生图和p图功能丰富,拆分图层功能好用,工作流能辅助创作。不过它生成速度慢,视频生成有画面逻辑、文字生成等问题。其开发节奏快。
基于DINOv2和SAM2改进的U-Net模型
DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。
Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”
来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力。