「高质量训练数据」共找到 4353 篇相关文章
刚刚,Anthropic新作:大模型意识被发现了
Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用
近年来大语言模型在长篇视觉叙事中潜力卓越,但长视频剪辑仍难控制。中科大等团队开源工作从系统工程视角研究多模态智能体在长视频编辑中的机制,重构剪辑管线,找到症结并给出解决办法。
拆解大模型几项核心操作背后的数学与 Infra 优化逻辑
文章拆解大模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后的数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。
4400 人收藏的开源排版项目!Kami:让 AI 生成的文档,终于有了值得一看的排版!
开源作者tw93因不满AI生成文档排版,开发了Kami。它是给AI写的文档设计系统,有一套跨文档的约束集合,支持六种文档类型,安装简单,能让AI生成的文档排版更专业。
LangFlow: 挑战离散扩散,探索下一代语言模型新范式
UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。
72小时狂揽50万美金GMV,AI短剧出海真正改变了什么?|甲子光年
2026年AI短剧与一人公司碰撞出新产业形态,海外市场规模将突破6.5亿美元。YourChannel平台创新分发与分账机制,让创作者快速变现,其模式与传统平台差异大,未来内容产业竞争重心或向token消耗权转移。
群核十五年:一家“被AI重新定价”的公司上市了|甲子光年
群核科技15年后在港上市,其以“酷家乐”在家居设计软件领域渗透高。它正从3D工具商迈向空间智能服务商,早期被低估,如今随AI发展,早期投入成为生产力,转型向机器收费。
CVPR Highlight|让无人机学会自己认路+锁位目标,国防科大给出一套新解法
国防科技大学 SAW Lab 团队联合多高校推出无人机实时地理定位系统「PiLoT」,首次仅靠单目 RGB 序列在 GNSS 拒止环境完成无人机及目标定位,性能达先进水平,成果被 CVPR 2026 接收。
POF | 上海理工大学梁梓浩、朱兵等:使用大语言模型进行气泡湍流实验数据处理
本文提出结合大语言模型(Time - LLM)与Transformer模型的复合框架处理气泡两相流热膜测量信号干扰。先由Time - LLM识别气泡干扰信号,再用Transformer模型修复。实验证明该方法高效、轻量且物理自洽。
阿里云 Tablestore 基于 Mem0 为 OpenClaw 构建记忆系统最佳实践
文章指出 OpenClaw 原生记忆有失忆、多 Agent 记忆不通等问题,介绍阿里云 Tablestore 基于 Mem0 为其构建记忆系统的实践,包括优势、安装步骤,实测记忆持久生效,还提及后续实践值得期待。