「气动数据重构」共找到 3345 篇相关文章
27、42、73,DeepSeek这些大模型竟都喜欢这些数!为什么?
技术作家发现GPT - 4o、Claude等模型猜数偏好42、73,Andrej Karpathy测试中模型多选27。网友猜测原因,如数据集、人类偏见等,也有论文分析此现象,多与数据分布有关。
DeepMind爆火论文:向量嵌入模型存在数学上限,Scaling laws放缓实锤?
DeepMind一篇关于向量嵌入局限性的论文在AlphaXiv爆火。其证明向量嵌入有数学上限,Scaling laws或放缓。研究构建LIMIT数据集,测试发现即便是先进嵌入模型也难解决简单任务,揭示了RAG系统约束,让人反思Scaling Laws边界。
BigQuery 新功能:SQL 直调 17 万 + AI 模型,3800 万行数据处理成本仅 2 美元
Google为BigQuery推出面向开源模型的第三方生成式AI推理功能,允许数据团队用SQL语句部署运行Hugging Face或Vertex AI Model Garden的模型,消除对独立ML基础设施的需求,解决数据团队痛点。
手术刀式去噪突破LLM能力上限,从头预训练模型下游任务平均提高7.2% | 中科院&阿里
中科院计算所与阿里Qwen等团队联合提出RefineX框架,通过程序化编辑任务实现预训练数据精炼。它将专家指导结果蒸馏为删除程序,训练优化模型。用其净化数据训练模型,下游任务平均提高7.2%。
具身智能空间视觉死穴,终于被最新顶会彻底解决!
招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。
The Sentient Interface: Art, Technology, and the Expanded Mind
在计算与数据主导的时代,艺术、科学与技术边界渐趋模糊。本次活动汇聚四位从业者,探讨如何将无形元素转化为审美体验,从生态数据到AI叙事,跨越学科探索人机关系与环境依存。
CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?
论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三大悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。
长程执行成具身智能必考题,墨奇的答案是Agentic-Native|甲子光年
具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。
“小龙虾”太多了,CPU告急
当地时间4月9日,谷歌与英特尔宣布扩大多年期合作,部署至强处理器并联合研发IPU。当前AI基础设施瓶颈从GPU向CPU迁移,CPU需求激增但供应紧张,引发产业链连锁反应,其价值重估受多因素影响。
ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术
清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。