大数据」共找到 6656 篇相关文章

新闻资讯7

开源模型TOP5,被中国厂商包圆了

10月公开数据显示中国开源模型占据榜单前五,阿里Qwen系列和DeepSeek影响力深远。从LMArena榜单、HuggingFace数据看,国产模型表现佳。还提及Llama 5相关传闻。

量子位
开源动态8

杨立昆亲自指导开源世界模型,为AI Agent打造超级

今天凌晨,Meta开源世界模型V - JEPA 2,它用超规模数据集训练,能让AI Agent理解物理世界。图灵奖得主杨立昆参与开发并推荐。模型经多方面改进,还拓展用于机器人规划和视频问答,效果良好。

AIGC开放社区
算法论文8

CVPR 2026 | EmoStyle:情感也能“风格化”?深VCC带你见证魔法!

EmoStyle由深圳学可视计算研究中心黄惠教授课题组完成。它解决图像情感风格化两挑战,提出有效方法、构建数据集、设计模块。实验显示其平衡情感与内容,还能扩展到文生图。

机器之心
8

企业数据“LLM ready”与“小Palantir”们的崛起 | AGIX PM Notes

文章指出当前 AI 仍处准备阶段,企业数据未就绪是落地障碍,深层问题是流程 AI 原生化转型。还介绍本周市场、多家科技企业动态,以及巴菲特和芒格对 ETF 的看法及投资建议。

海外独角兽
算法论文7

函数向量对齐技术,让模型持续学习不“失忆”丨ICLR 2025

中国科学技术学等校团队破解语言模型灾难性遗忘之谜,发现遗忘源于模型激活带偏差新功能,非覆盖旧功能。还设计FVG训练法,保留并对齐函数向量,保护模型能力。相关论文被ICLR2025接收,代码开源。

量子位
开源动态8

Agent记忆赛道洗牌!LoCoMo-Refined重磅发布,主流记忆框架迎来核心检验

南京学与上海人工智能实验室联合推出 LoCoMo-Refined,这是严苛的 Agent 记忆评测基准。它指出当前记忆评测基准有两漏洞,在其标准下主流记忆框架得分普降,且相关数据集和评测脚本已开源。

AI科技评论
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
算法论文8

清华上交满分论文证明:强化学习并不能让模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
算法论文8

单卡即可微调模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技学和香港中文学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
产品应用8

腾讯模型动作慢了吗?姚顺雨带着Hy3 preview杀进第一梯队

国内模型发展迅速,腾讯此前动作较慢。姚顺雨加入后推动变革,混元团队重建推出Hy3 preview,有295B总参数和快慢思考融合架构,开源且性能优,在多方面表现出色,成本下降。

AIGC开放社区