预训练数据精炼」共找到 3936 篇相关文章

推荐文章7

MiniMax 怎么做 Agent:Model-Harness 协同只是第一步,还有 Inference-Harness 协同

本文介绍了 MiniMax 在 Agent 层面的实践。从内部飞书 bot 起步,发展成桌面应用 MiniMax Code,形成训练 - 服务闭环。还阐述 Agent 对模型优化迭代的作用、自研 Agent 优势,指出 AGI 是闭环递归自我改进系统。

Founder Park
新闻资讯8

两个哈佛女生用AI做电池故障排查,数月的工作量被缩到了几分钟

哈佛毕业女生 Eva Tuecke 和 Catherine Yeo 创立 Altara 公司,获 700 万美元种子轮融资。其系统能整合电池等物理科学领域分散数据,将故障排查时间从数月缩至几分钟,还能确保输出可审查,适应不同机构需求。

DeepTech深科技
产品应用8

全域感知,一键部署:“星元智能体”开启国产AI落地新范式

4月29日,数字感知芯片技术全国重点实验室联合中星微团队发布‘星元智能体’。它基于XPU芯片,完成从芯片到智能体跨越,架构创新破算力瓶颈,还破解数据困局,已在多地试点,未来将推动AI产业发展。

芯师爷
算法论文8

Pipeline MinerU真快不行了

文章聚焦Infinity-Parser,指出它把OCR从‘做识别’推进到‘做结构’。它采用layoutRL强化学习框架,结合真实与合成数据构建Infinity-Doc。跑分强且复杂结构表现优,透露Document AI向结构化生成转变趋势。

CourseAI
产品应用8

YOLO + OpenClaw 缺陷检测智能体,低代码实战方案

文章介绍了YOLO + OpenClaw缺陷检测智能体低代码实战方案。先指出实时检测延迟问题,提出离线自动化方案。接着讲训练YOLO模型、创建OpenClaw技能、配置自动化任务及企业微信集成,还对比了与人工质检效果。

机器学习AI算法工程
算法论文8

为什么Agent总是Demo猛如龙实战一条虫?

一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。

量子位
开源动态8

12ms!一个仅8M的语音停顿检测模型

语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。

AI工程化
算法论文8

大模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力

空间推理是多模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。

量子位
开源动态8

音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考

Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。

AIGC开放社区
新闻资讯7

他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!

37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。

新智元