「数据集构建」共找到 4068 篇相关文章
世界模型混战,Momenta率先冲刺IPO
当下世界模型是AI领域热门且混乱的概念,主流路线有四类。Momenta的R7世界模型已量产,其CEO定位公司为物理AI基座模型构建者。Momenta率先冲刺IPO,商业模式正转型,为后续玩家提供价值评估体系。
AI 原生软件工程的可观测性与可控制性
文章指出 AI 成研发主力军,改变软件生产方式,传统研发管理办法需升级。当前人和 AI 协作有诸多问题,介绍了研发三阶段,阐述可观测性与可控制性概念、关键指标,以及实现可控制性的要素,强调二者结合构建高效研发体系。
告别碎片化日志:一套方案采集所有主流 AI 编程工具
在AI编程工具普及的当下,有效采集和分析AI代码生成数据成重要课题。该文介绍一套基于MCP架构的多AI工具代码采集方案,支持多种工具和操作系统,有轻量化、用户无感等特点,已和Aone合作。
Coding Agent 在百度的落地实践:从反馈闭环到工程范式重构
本文整理自百度文心快码研发经理牛万鹏演讲,介绍了Coding Agent在百度的落地实践。包括落地成效、Agent Loop框架问题、Feedback Loop构建、Benchmark评测及Agent Engineers理念,还提及企业级Agent落地的工程问题。
凌晨三点写代码、10个 Agent 同时跑!ClawdBot 创始人自曝 AI 上瘾史:Claude Code 入坑,Codex 成主力
本文讲述 ClawdBot 创始人 Peter Steinberger 的开发经历。他曾打造知名 PDF 框架,后经历倦怠回归,借 AI 重塑开发方式。分享入行故事、用 AI 编程的日常及构建 ClawdBot 的过程,探讨软件工程变化及对新人的建议。
AI用3年时光,来了解你!首个AI Clone长期记忆基准
现有AI记忆评测存在数据源单一、忽视变化本质、注入成本高等局限。开源学术社区QuantaAlpha联合高校团队提出CloneMem基准测试,构建合成人生,设计评测任务,实验发现简单方法在检索上更有效,记忆系统应还原信息。
AI医生终于有了硬标尺!全球首个专病循证评测框架GAPS发布,蚂蚁联合北大王俊院士团队出品
蚂蚁健康与北大王俊院士团队发布全球首个大模型专病循证能力评测框架GAPS及评测集GAPS - NSCLC - preview,解决现有医疗AI评测局限,成果已应用于“蚂蚁阿福”,并客观评价了大模型临床能力。
从 LLM 到 World Model:为什么我们需要能理解并操作世界的空间智能?
文章指出 LLM 仅靠语言不足以支撑真正智能,构建空间智能与世界模型成关键方向。2024 年李飞飞等创立 World Labs,11 月推出 3D 世界生成模型 Marble,本文探讨空间智能重要性及世界模型如何成转变基础设施。
首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS
EverMind团队发布面向人工智能智能体的长期记忆操作系统EverMemOS。它在主流评测集表现超此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。
开源!强效果,高性能,严隐私?我全都要:OPPO 终端大模型实践
OPPO AI 中心推出开源端侧多模态大模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经多阶段训练,OPPO 还构建端侧部署方案,评测显示其在多方面表现优异,未来会继续技术革新。