大模型数据」共找到 9982 篇相关文章

算法论文7

AI根本守不住秘密!不依靠模型的输出过滤才是铜墙铁壁

开发者常把秘密放系统提示词,以为安全。Swept AI和密西根学团队测试发现,攻击者不断尝试,AI会泄露秘密。多种依赖模型的防御方案失败,只有输出过滤能零泄露。

AIGC开放社区
产品应用7

多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造高效经济的模型存储平台

有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。

InfoQ
算法论文8

CVPR2026 | Streamo:让模型变成实时流式交互助手

香港浸会学联合腾讯优图实验室提出 Streamo,将‘何时回答’变为模型预测的 token,通过端到端训练框架把离线视频模型转化为实时流视频助手,还构建 Streamo - Instruct - 465K 数据集,实验效果良好。

机器之心
开源动态8

王兴一鸣惊人!美团首个开源模型追平DeepSeek-V3.1

美团首个开源模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对模型的理解,还有新发现,且性能好、训练效率高。

量子位
推荐文章8

5 分钟搞懂开源模型选型核心维度,16G显卡也能选对

文章以作者自身经历引入,指出开源模型选型易陷入‘越越好’误区。讲透选型4个核心维度,含实操步骤与避坑指南,还介绍选后评估方法,助新手快速锁定适配模型

机器学习AI算法工程
推荐文章8

端到端语音模型:从语音表征到模型架构

本文整理自阶跃星辰语音模型负责人杨学锐在2025年QCon全球软件开发会的分享。介绍模型对语音技术的重塑,涵盖识别、合成等方面;阐述端到端语音模型构建,涉及表征、架构、训推和任务;还提及模型评估方法。

InfoQ
新闻资讯7

Meta发最强模型打响价格战,小扎对谷歌贴脸开!北校友立

九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升、成本低,性价比高,但也遭质疑,模型下半场或比拼系统架构和智能体工程能力。

新智元
算法论文8

模型解数学题是真懂还是 “死记硬背”?|首个反例驱动的数学推理基准揭穿 “刷题式假象”!

随着语言模型在数学领域应用渐广,其是否真具备数学推理能力成焦点。清华等团队提出反例推理评测基准COUNTERMATH,测试20+主流模型,结果不佳,而小样本微调能显著提升模型能力。

深度学习自然语言处理
新闻资讯8

对话智源王仲远:机器人的小脑可能会“合体”,但不是今天

今年智源会上,智源研究院推出“悟界”系列模型,如Emu3、Brainμ、RoboOS2.0、RoboBrain2.0和OpenComplex2。智源研究院长王仲远称模型技术未到尽头,介绍了模型特点及发展趋势,如机器人小脑融合需时间。

AI前线
新闻资讯8

「全球模型第一股」来了!智谱港交所敲钟,市值达528亿港元

2026年1月8日,智谱登陆港交所,成全球首家以AGI基座模型为核心业务的上市公司,市值528.28亿港元。它以‘全球模型第一股’吸引资本,研发强、MaaS模式优,标志中国AGI企业走向资本市场。

新智元