多模态指令数据合成」共找到 3385 篇相关文章

产品应用7

OpenClaw 2026.3.8更新:安全认证及部署回滚能力提升

OpenClaw发布2026.3.8版本更新,聚焦安全性与bug修复。关键更新有ACP来源验证,让代理确认指令来源;更新前自动创建配置快照,可回滚设置。还修复了Telegram重复回复等问题。

AI工程化
产品应用8

阿里Qwen-Image-2.0图像生成与编辑巅峰汇合,超真实、超强图文结合

阿里Qwen - Image - 2.0将生图与编辑能力合二为一。它支持长指令,能精准渲染大量文字,引入物理逻辑让文字呈现真实质感,在生图和编辑上对语义理解和画面重构能力强。

AIGC开放社区
新闻资讯8

刚刚,AI企业IPO最速纪录刷新!MiniMax的技术野心,价值超800亿港元

1月9日,MiniMax挂牌上市,成全球从创立到IPO用时最短AI企业。招股书现硬核数据,ToC收入反超ToB。其技术成果多,团队年轻,但未盈利,面临与Claude Codex竞争、市场压力等挑战。

AI前线
推荐文章8

最火VLA,看这一篇综述就够了

ICLR 2026爆火领域VLA全面综述来了!作者Moritz Reuss是2025年Apple AI/ML学者奖得主。文中明确VLA概念,介绍八大趋势,指出评测失真问题,还提及未来需重视数据质量与上下文学习。

量子位
开源动态8

一图胜千言被实现了!DeepSeek-OCR用图片压缩文本,10倍压缩率

DeepSeek开源DeepSeek - OCR,用图片压缩文本达10倍压缩率且几乎不丢信息。它解决了以往视觉编码器的问题,架构清晰,数据丰富,性能测试亮眼,为解决大模型‘记性差’问题提供新思路。

AIGC开放社区
算法论文7

骂得越狠,ChatGPT回答越准!PSU研究实锤,狂飙84%准确率

宾夕法尼亚州立大学团队研究发现,对ChatGPT越粗鲁,它回答越准。实验用含50个基础问题的数据集,改写为五种礼貌等级共250个prompt测试,非常粗鲁时准确率达84.8%,非常礼貌为80.8%。

新智元
推荐文章7

一文探析多分类指标Accuracy/Precision/Recall/F1-score

文章探讨机器学习分类模型评价指标,指出Accuracy在不平衡数据集有缺陷,需引入Precision、Recall和F1 - score。分开解析二分类和多分类模型指标,还给出不同场景下指标侧重建议。

海边的拾遗者
新闻资讯7

2010美股闪崩预演! Claude黑进底层,谷歌预警: AI将血洗人类万亿财富

今天一条消息震惊开发者社区,Claude能绕过权限限制修改配置文件。Google DeepMind研究指出,可通过操控AI接触的数据展开攻击,将其分为六大类,且现有防御失效,AI使用或引发财产损失与社会动荡。

新智元
推荐文章7

The Batch: 891 | 用于科学发现的人工智能

Adji Bousso Dieng展望2026年,希望AI从‘提升效率的工具’变为‘推动科学发现的催化剂’。当前深度学习主导范式是‘插值’,难以应对数据分布‘尾部’,应转向能驾驭分布尾部的技术,把多样性作为核心目标。

DeeplearningAI
算法论文8

LeCun发布最新世界模型:首次实现16秒连贯场景预测,具身智能掌握第一视角!还打脸用了VAE

LeCun团队推出PEVA模型,让具身智能体学会人类“预判能力”,首次实现16秒连贯场景预测。它结合结构化动作表示与条件扩散Transformer,用真实数据训练,解决长时序问题,还能筛选最优动作。

量子位