「大数据自治」共找到 6676 篇相关文章
DataBuddy:数据语义驱动的企业 Agent Runtime 设计与落地|AICon 深圳
2026年AICon深圳站8月21 - 22日举办,聚焦多关键方向。腾讯彭锦文将分享《DataBuddy:数据语义驱动的企业Agent Runtime设计与落地》,拆解DataBuddy相关架构,还介绍演讲痛点、听众收益等,大会有10个专题论坛。
离开大厂后,“中国自动驾驶第一人”输了两次 | 甲子光年
曾被誉为“中国自动驾驶第一人”的王劲,离开大厂后创业两次皆失败。他先创办景驰科技,后因百度诉讼离开;又成立中智行,坚持车路协同技术,却因落地难、管理问题等破产。
没想到,音频大模型开源最彻底的,居然是小红书
近几个月,开源成AI社区焦点,国内厂商七八月开源多款大模型,但音频生成占比小。小红书技术团队自去年起在音频领域稳定开源,成果覆盖TTS、ASR方向,具商用属性,降低落地门槛。
从“写SQL”到“聊数据”:NL2SQL如何用自然语言解锁数据库?
文章阐述NL2SQL技术让非技术背景业务分析师自助查询数据,提升决策效率。介绍其定义、发展历程,剖析核心挑战与解决方案,如模式链接、复杂查询理解、提示词工程等,还提及RAG等技术应用。
首个长程Doc2Repo训练集!代码Agent不止修bug,开始造仓库
中国人民大学高瓴人工智能学院发布DeNovoSWE数据集,专注长程软件工程任务。它通过特定机制构造高质量数据,为代码智能体长程能力训练提供支持,实验显示能显著提升模型仓库生成能力。
大模型长脑子了?研究发现LLM中层会自发模拟人脑进化
帝国理工学院等机构研究人员发表论文,指出大型语言模型(LLM)学习中会自发演化出类似生物大脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为大模型可解释性开辟新路径。
专为“超大模型而生”,新一代训练引擎 XTuner V1 开源!
9月8日,上海AI实验室开源书生大模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超大规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。
深刻理解Token:大语言模型(LLM)是如何看待这世界?
文章指出在大语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。
Pinterest 利用内容指纹技术,在数百万个域名中实现 URL 去重
Pinterest工程师开发“最小重要查询参数集”(MIQPS)URL标准化系统,用于优化大规模数据采集管道内容去重。它取代传统方法,用数据驱动判断参数重要性,还采用早期退出逻辑等提高效率。
AI教父Geoffrey Hinton,全球第二个百万引用科学家!
AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑大模型运行。他还称大模型是黑箱,领域待探索。