大模型数据」共找到 9982 篇相关文章

推荐文章7

模型狙击黑产:挚文集团社交生态攻防实战全揭秘

挚文集团生态技术负责人李波在AICon会分享模型在社交生态落地实践。介绍集团生态问题,提出构建治理框架,还阐述多模态模型研发方案、细粒度用户画像建设及审核侧应用,最后总结现状并展望未来。

InfoQ
开源动态8

全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑模型

中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。

新智元
新闻资讯8

对话淘宝姜宇宁:如果你只推低价商品,是不需要用语言模型

淘宝姜宇宁团队上线RecGPT百亿参数推荐模型,对“猜你喜欢”功能技术升级。模型赋予传统推荐系统新能力,如让其“白盒化”、理解长上下文等。姜宇宁认为AI要创造商业价值,落到业务场景形成正向循环。

AI科技评论
算法论文7

POF|清华学张宇飞团队:采用数据驱动湍流模型的三维增升装置模拟

传统RANS方法预测分离流动有挑战,数据驱动湍流模型泛化性能有局限。清华学张宇飞团队研究其在复杂三维增升装置应用,验证SST - CND模型泛化能力及修正项迁移能力,证明其可用于真实工程流动问题。

力学与人工智能
算法论文7

你永远叫不醒装睡的模型!多轮对话全军覆没,性能暴跌39%

研究人员进行超20万次模拟实验,耗资5000美元,评估模型在多轮对话中的表现。结果显示,模型在多轮对话中性能明显低于单轮对话,平均下降39%,还出现“对话迷失”现象。

新智元
新闻资讯7

性能翻番背后:讯飞与昇腾,如何用国产算力炼就模型?|甲子光年

在全球AI竞争激烈背景下,科讯飞与华为昇腾深度合作意义重。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速模型行业落地。

甲子光年
算法论文8

全新预训练数据筛选方案,让数据效率提升10倍!配置仅需fastText评分器|港科vivo出品

香港科技学和vivo AI Lab提出轻量级高效数据选择方法PreSelect,已被ICML 2025接收。它只需训练部署基于fastText的评分器,减少10倍计算需求,在多数据集实验中效果显著优于其他方法。

量子位
算法论文8

链式思维是幻象吗?从数据分布视角重新审视模型推理,马斯克回复,Grok破防

亚利桑那州立学研究发现,思维链(CoT)推理可能只是对训练数据分布内模式的复现,输入与训练数据分布有差异时,推理链条会失效。研究探究了CoT泛化性等问题,对实际应用提出警示。

机器之心
算法论文8

EMNLP2025 | 解耦视觉与推理,港探索视觉语言模型"眼智分离"新范式

当前视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
算法论文8

博士答辩PPT分享 | 高雷诺数湍流场数据同化与湍流模型机器学习研究

西北工业学孙旭翔博士的论文聚焦航空航天湍流模拟难题,结合数据驱动与同化方法,构建全流程框架,提出数据同化与模型修正方法,设计集成框架,实现高雷诺数复杂流动精确高效模拟。

力学与人工智能