「后训练流程」共找到 4410 篇相关文章
数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免
研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。
一种基于滑动层合并的高效深度修剪大模型的方法
文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。
从Rax+DX到React,一次跨端组件重写的AI提效探索
本文基于M站首页重构项目,讲述借助AI编程工具Cursor和结构化Prompt,完成从Rax到React的组件迁移、DX到React的跨端重写,实现业务逻辑优化与工程规范落地,还分析了AI提效的优劣并总结迁移范式。
2025AI产品用户需求调研报告:AI产品的用户类型细分与画像分析 | 甲子光年智库
甲子光年智库基于调研数据开展AI产品用户研究,分析目标用户界定、类型细分与画像。指出新一代AI会重塑用户习惯,需探寻产品最终形态,还给出用户需求、类型分布等多方面结论。
香港科技大学、Manycor开源空间大模型,超3000颗星
香港科技大学、Manycore联合开源空间大模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型。
一张小卡片敢卖999?原来是智能体AI硬件
出门问问发布全球首款智能体AI硬件TicNote,有录音转写、翻译等功能,外观小巧便携。今年4月海外上市获好评,现国内版上线,售价999元起。出门问问坚持软硬结合,未来Shadow AI将搭载更多硬件。
Replit ARR 突破 1 亿美金,1000 万到 1 亿只用了6 个月
Replit 从在线编程工具起步,借助 AI 能力实现增长。近期宣布 ARR 突破 1 亿美金,从 1000 万到 1 亿仅用 6 个月。它起源于降低编程门槛的愿景,早期营收不佳,2024 年转型后靠 Agent 产品爆发。
深入解析|Cursor编程实践经验分享
文章结合近两个月实践,分享Cursor编程经验,探讨其适用场景与问题。介绍使用方法,如标准Prompt、Rules等,还提及MCP工具及Cursor不足,对比DeepResearch等平台,最后介绍AutoGPT、Claude4.0等技术。
先设计再写代码,还是先实现再重构?AI 编程让这种选择变的简单
传统手工编程时代,先设计再写代码和先实现再重构存在争论。AI编程让选择变简单,可先设计生成代码,再改进设计生成。还需在开发工具和流程上配合,新人更易适应。
2K+ star!这款分分钟搭建 AI 知识库的项目,真的绝了!
GitHub上爆火的开源项目PandaWiki,两周揽2K star,是AI大模型驱动的知识库搭建系统。它将AI能力深度融入全流程,有强大富文本编辑等特色,还能灵活部署,适合中小团队和个人开发者。