大数据任务」共找到 7722 篇相关文章

算法论文7

让推荐学会思考:用强化学习激活模型的序列推理能力

文章指出推荐系统曾未紧密结合模型能力,如今正靠近其训练范式。作者基于用户行为序列,用强化学习训练模型理解序列关系,以预测用户下一个可能点击的资讯,并通过实验验证了该方法的可行性,还探讨了不同数据库中BM25算法的差异。

AI科技评论
新闻资讯8

解析科讯飞:把AI做成懂你的那一个|甲子光年

2025年中美AI发展路径分化,中国企业探索本土商业化道路。科讯飞董事长刘庆峰提出自主可控、软硬一体、行业纵深、个性化四个关键词。其用华为昇腾芯片训练出可商用模型,在多领域展现优势,还发布新功能和产品,为AI商业化提供“中国答案”。

甲子光年
新闻资讯7

MMAR与AudioTrust技术解读,音频模型评测前沿进展分享 | AI Bench Talk直播预告

司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频模型相关议题。

OpenMMLab
算法论文8

迎接范式革命:最新、最全的模型Latent Space综述,NUS、复旦、清华等联合出品

模型核心计算正从显式空间转向潜在空间,现有文献缺乏统一视角。NUS、复旦等机构的综述《The Latent Space》从五视角构建框架,阐述潜在空间基础、演进、机制、能力,指出挑战与未来方向。

机器之心
算法论文7

token危机解决?扩散模型数据潜力3倍于自回归,重训480次性能仍攀升

新加坡国立学AI研究者Jinjie Ni团队预训练扩散语言模型(DLMs)与自回归(AR)模型,发现DLMs是超强数据学习者,数据潜力超AR 3倍,重训480次性能仍攀升,还剖析同期研究方法论缺陷。

机器之心
开源动态8

史上最高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”

上海创智学院、上海交通学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗模型或成最优解,它参数量,在多评测中登顶,技术优势明显。

机器之心
开源动态8

钢铁版OpenClaw,Transformer作者用Rust打造,告别数据裸奔

OpenClaw开源后虽发展迅速,但存在严重安全问题,如数据明文处理、隐私保护缺失、恶意组件等。Transformer论文作者Illia Polosukhin用Rust打造IronClaw,重构底层架构,升级记忆引擎,还指向去中心化经济。

AIGC开放社区
新闻资讯7

用得越多、失业越快?GitHub 改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练AI模型,Business和Enterprise用户除外。GitHub称需更多数据覆盖编码场景,但此举遭用户吐槽。

AI前线
产品应用8

只用国产GPU训练的模型性能飙升100%!国内唯一,更懂你

讯飞发布全国产算力训练的讯飞星火X1.5,推理效率暴涨100%,综合性能跻身全球顶级。还首发非自回归语音模型架构,效果提升、成本降低。此外,展示多领域应用成果,发布相关产品,开源智能体平台。

新智元