数据构建」共找到 3974 篇相关文章

开源动态8

统一VLA范式!港科大开源StarVLA乐高式架构,复现成本大幅降低

当前具身智能的VLA赛道陷入「碎片化」泥潭,方法难对比、复现成本高。港科大开源StarVLA,提出「乐高式」统一架构,构建模块化开源底座,实现双向模块化,还支持多种训练范式,打通Sim2Real。

新智元
算法论文8

迎接范式革命:最新、最全的大模型Latent Space综述,NUS、复旦、清华等联合出品

大模型核心计算正从显式空间转向潜在空间,现有文献缺乏统一视角。NUS、复旦等机构的综述《The Latent Space》从五大视角构建框架,阐述潜在空间基础、演进、机制、能力,指出挑战与未来方向。

机器之心
开源动态7

YC总裁开源个人AI记忆系统GBrain:让你的OpenClaw/Hermes长脑子

YC总裁Garry Tan开源GBrain,这是经实战检验的AI记忆中枢。它有真实数据规模、混合搜索架构等特点,核心工作流含实体检测等。技术选型有考量,还提供体验方式和技能包文档。

AI工程化
产品应用7

Pinterest 部署生产级模型上下文协议生态系统,赋能 AI 智能体工作流

Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智能体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还能执行多种任务。

InfoQ
开源动态8

阿里搞了个全能解析器,文档、图片、音频、视频一锅端

阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,在自建基准上多项指标超越 Gemini - 3 - Pro。

CourseAI
产品应用8

aiX-apply-4B逆袭DeepSeek-V3.2!aiXcoder发布代码变更应用模型,单卡推理提效15倍

3月25日,硅心科技发布专为代码变更应用场景设计的模型aiX - apply - 4B。它平均准确率达93.8%,超越Qwen3 - 4B和DeepSeek - V3.2,算力成本仅为后者5%,推理速度提15倍。还采用创新训练方法,适配企业场景。

机器之心
8

谷歌公开全新极限压缩算法:LLM提速8倍、内存占用狂降6倍,精度零损失

谷歌推出全新量化算法 TurboQuant,瞄准大模型键值缓存吃内存、高维向量搜索算力瓶颈痛点,能砍内存、提速度且精度零损失。分 PolarQuant 和 QJL 两步,实验数据表现优异,将改变搜索格局。

AI寒武纪
算法论文7

做RAG这一年,最后悔的就是上知识图谱

基于知识图谱的检索增强生成在问答任务中存在三元组索引丢失上下文语义问题,作者提出MDER - DR双阶段框架,在标准测试和特定数据集上性能提升最高66%,还具备多方面优势。

PaperAgent
开源动态7

XcodeBuildMCP:让 AI 像开发网页一样搞定 iOS/macOS 应用

Sentry开源的XcodeBuildMCP项目,打破传统AI辅助开发手动验证循环,通过MCP和CLI让AI代理操作Xcode构建系统,实现自动化开发流程。它配置简单,能覆盖日常开发需求,助力iOS开发迈向‘无人值守’。

AI工程化
推荐文章7

Prompt、Skills、MCP:大模型上下文工程核心链路

文章聚焦大模型上下文工程,介绍了Prompt、Skills、MCP核心链路。Prompt是与模型沟通基础,但其有脆弱、难管等痛点,促使向上下文工程演进;Skills是能力单元,可显式化能力、动态组合;MCP解决能力集成问题,虽有争议但理念重要。

AIGC开放社区