大数据」共找到 6669 篇相关文章

算法论文8

入选 SOSP'25:百度智能云对象存储的分布式层级 Namespace 破解业界难题,彻底扫清 AI 时代大数据上云障碍

百度沧海・存储团队与高校合作的论文被 SOSP'25 录用,介绍了百度智能云对象存储 BOS 的分布式层级 Namespace 系统 Mantle。它攻克业界难题,融合文件和对象存储优势,性能卓越,已在 BOS 生产环境规模上线超两年。

InfoQ
开源动态8

群核科技开源两款空间模型,想解决 Genie3 没能彻底解决的问题

2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间模型,开源SpatialLM 1.5和SpatialGen。两款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。

Founder Park
算法论文8

0人工参与实现梯度更新!MIT新框架让AI自动生成微调数据,权重自主升级

MIT提出新强化学习框架SEAL,可让模型生成微调数据和自我更新指令,实现权重更新。无需人工,模型能自动梯度更新。经知识注入和小样本学习实验验证效果,还介绍了其双循环工作机制。

量子位
算法论文7

一招缓解LLM偏科!调整训练集组成,“秘方”在此 | 上交&上海AI Lab等

上海交和上海AI Lab联合团队提出IDEAL方法,可提升LLM综合性能。研究发现SFT阶段数据数量非关键,配比不当会加剧模型“偏科”。以Llama3.1 8B测试,IDEAL能提升代码能力,还指导了超参数选取。

量子位
开源动态8

真实评估!北理发布全球首个「全场景教育」基准,支持4000+情境

北京理工学高扬老师团队推出EduBench,是全球首个「全场景教育」基准,涵盖9教育场景、12个评估维度、超4000个情境。团队将数据、模型等全面开源,评估发现模型在特殊教育场景有不足,还提出多源知识蒸馏等方法。

新智元
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强模型横扫全球医学考试!

百川智能发布首个循证增强医疗模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元
开源动态8

刚刚开源了 CLI-Anything!一个命令让任意软件秒变 AI Agent 原生工具!

香港数据科学实验室团队开源 CLI - Anything,它以 CLI 为桥梁,将人类软件转变为 Agent 能用的工具。该项目有一键生成 CLI、真实软件集成等亮点,还给出快速入手步骤和使用示例,未来规划宏

开源星探
算法论文8

AAAI 2026 Oral | 模型「爱你在心口难开」?深度隐藏认知让推理更可靠

合肥工业学团队提出模型存在‘隐藏的真伪认知’,论文让模型用此给推理‘打分’,过滤错误推理链。通过多层注意力头探测、构建预测器和新推理扩展策略,提升了推理链稳定性,实验效果优异。

机器之心
算法论文8

IEEE TVCG | 告别写代码!MoGraphGPT:基于模块化模型与图形控制的2D交互场景创作

香港多所高校研究团队提出 MoGraphGPT 系统,结合上下文感知模块化模型与图形化控制,能让用户零代码搭建 2D 交互场景。该成果被 IEEE TVCG 录用,还对比实验验证其优势。

机器之心
8

AI真的需要「像人类」那样思考吗?AlphaOne揭示属于模型的「思考之道」

近年模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊学厄巴纳 - 香槟分校和加州学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现无需训练的推理调控,实验显示其能提升准确率和效率。

机器之心