大模型数据」共找到 9971 篇相关文章

推荐文章8

模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
新闻资讯8

训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法

模型应用于特定领域需数据微调,但筛选高保真训练数据难度、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
新闻资讯7

《AI模型与异构算力融合技术白皮书》正式发布

10月10日,中科算网等联合发布《AI模型与异构算力融合技术白皮书》,聚焦模型开发痛点,为开发者提供技术参考。白皮书介绍全球模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。

AIGC开放社区
新闻资讯7

AI 渗透金融行业:模型如何破解风控、服务与决策难题?

在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨模型赋能金融,涉及风控、服务、决策等难题,分享了模型应用场景、技术渗透、权衡可解释性与性能等观点。

InfoQ
推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 会上,vivo AI 架构师王兆雄分享多模态模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线
产品应用8

千卡集群破壁之道:vivo视觉多模态模型训练效率跃迁实战

多模态模型在多领域需求增长,但千卡级 GPU 训练挑战。vivo AI 架构师王兆雄在会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ
推荐文章7

模型之外,向量存储如何支撑 Agent 的检索链路

文章指出模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。

阿里云开发者
新闻资讯8

20万人抢的全球模型第一股,我中签了

智谱在港交所上市成全球模型第一股,作者申购中签。智谱专注AI Coding,迭代快,GLM - 4.7成绩亮眼,商业化数据佳,还有诸多有意思细节,虽行业竞争,但它表现不错。

花叔
算法论文8

模型上车:理想汽车硬件协同设计算出最佳边缘模型

长三角洲AI实验室、中科院、理想汽车等找到语言模型硬件协同设计寻优之路,在相同延迟下降低端侧模型困惑度,压缩模型架构挑选时间。研究揭示缩放定律,打造硬件感知建模框架,找到精度与延迟最优解。

AIGC开放社区
开源动态8

终结数据荒!智源开源首个Deep Research数据合成框架InfoSeek

模型深度研究中,高质量数据是短板。近日,智源研究院发布首个面向深度研究的开源数据集InfoSeek,提出「扩散 - 回溯」数据合成方法,用3B模型在基准测试中接近商业模型表现,且数据集可扩容。

新智元