「RL后训练」共找到 3864 篇相关文章
一种基于滑动层合并的高效深度修剪大模型的方法
文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。
2025AI产品用户需求调研报告:AI产品的用户类型细分与画像分析 | 甲子光年智库
甲子光年智库基于调研数据开展AI产品用户研究,分析目标用户界定、类型细分与画像。指出新一代AI会重塑用户习惯,需探寻产品最终形态,还给出用户需求、类型分布等多方面结论。
香港科技大学、Manycor开源空间大模型,超3000颗星
香港科技大学、Manycore联合开源空间大模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型。
一张小卡片敢卖999?原来是智能体AI硬件
出门问问发布全球首款智能体AI硬件TicNote,有录音转写、翻译等功能,外观小巧便携。今年4月海外上市获好评,现国内版上线,售价999元起。出门问问坚持软硬结合,未来Shadow AI将搭载更多硬件。
Replit ARR 突破 1 亿美金,1000 万到 1 亿只用了6 个月
Replit 从在线编程工具起步,借助 AI 能力实现增长。近期宣布 ARR 突破 1 亿美金,从 1000 万到 1 亿仅用 6 个月。它起源于降低编程门槛的愿景,早期营收不佳,2024 年转型后靠 Agent 产品爆发。
GitHub CLI 增强了对三角工作流的支持
2025年4月,GitHub宣布更新其CLI,增强对三角工作流的支持。此工作流涉及原始库、个人分支和本地环境,更新前gh pr命令有管理难题,改进后获开发者好评,还对比了GitLab和Bitbucket相关支持情况。
0%通过率!Code神话泡沫!LiveCodeBench Pro发布!
国际算法奥赛金牌得主团队测试20个顶级大模型,在584道编程赛题上,高难度题目AI通过率为0%。论文发布LiveCodeBench Pro评测方法,揭示AI编程能力神话泡沫,指出其问题并给出提升方向。
伪品会丨盘点那些 AI 六小龙下架或停运的产品
作者出于兴趣体验上千款AI产品,结合知乎提问,引出对已下架或停运AI产品的讨论。指出AI虚拟陪伴和AI创作工具赛道倒下产品多,还盘点了AI六小龙撑不过一年的产品,强调从失败中汲取经验。
大概念模型:AI 推理的新范式
大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。
15亿美元AI独角兽崩塌,全是印度程序员冒充!微软亚马逊惨遭忽悠
Builder.ai自称用AI简化软件开发,吸引微软、软银等巨额投资,估值超15亿美元。但实际靠人工冒充AI,创始人虚报营收。丑闻曝光后投资被冻结,公司破产,引发AI交易技术尽职调查讨论。