多模态理解与生成」共找到 3413 篇相关文章

新闻资讯7

一句话生成“非程序员的 Claude Code 指南”,比 NotebookLM 更好用

2026年,Anthropic公司的Claude Code成热议话题。它因AI Coding火和公司能力强受关注。Anthropic CEO认为初级甚至部分高级开发工作将大多由AI完成。Claude Code不仅适合开发者,也能为普通用户提供多种功能。还能用Google Gemini图文并茂功能一句话生成其学习指南。

MacTalk
新闻资讯7

AI系统10分钟生成CVE漏洞利用程序:网络安全攻防战进入“分钟时代”

研究人员开发的AI系统能10 - 15分钟生成CVE漏洞利用程序,成本约1美元,准确性和可靠性高。此外,HPTSA系统可利用零日漏洞。传统网络安全防御模式失效,攻防失衡加剧,AI攻防对抗趋势明显,有专业化、自主化、高强度特点。

AIGC开放社区
算法论文8

SFT在帮倒忙?新研究:直接进行强化学习,模型多模态推理上限更高

学界常用「监督微调(SFT)+ 强化学习(RL)」训练大模型。但新研究发现,SFT 会引发「伪推理路径」,阻碍推理进步。相比之下,直接进行 RL 训练,模型多模态推理上限更高,该团队训练的模型还刷新了纪录。

机器之心
算法论文8

ICLR 2026 | CineTrans: 首个转场可控的多镜头视频生成模型,打破闭源技术壁垒

随着视频生成模型发展,影视级长视频需多镜头序列及自然转场,这成新挑战。上海人工智能实验室团队提出 CineTrans 模型,基于掩码机制实现自动化转场,还构建 Cine250K 数据集,实验效果超基线。

机器之心
算法论文8

效果、性能双突破,快手OneSug端到端生成式框架入选AAAI 2026

查询推荐是电商搜索关键功能,传统方法有局限。快手提出OneSug端到端生成式框架,统一多阶段,提升效果与效率,成果入选AAAI 2026,已在快手电商全量推广,显著提升多项指标。

机器之心
新闻资讯8

汪军对话 Rich Sutton:大模型在一定程度上分散了我们对智能理解的注意力

在RL China 2025开幕式上,汪军与图灵奖得主Richard Sutton对话。Richard认为大模型缺乏目标和奖励,分散对智能理解的注意力。他强调RL核心是从经验学习,智能原则含梯度下降等,建议将目标解读为“奖励”。

AI科技评论
产品应用7

Target 公司借助生成式 AI 推荐将“加入购物车”互动率提升 11%

Target公司为应对零售目录中配套产品组合复杂挑战,部署基于生成式AI的配件推荐系统GRAM。它用大模型分析产品数据,结合人工审核,A/B测试显示提升了互动率和转化率,已全面投入生产。

InfoQ
新闻资讯8

a16z 发布百大【生成式AI】消费级应用排行榜第五版

a16z发布第五版百大生成式AI消费级应用榜单,揭示普通人使用AI习惯的演变,生态趋于稳定。谷歌多款产品上榜,Grok与Meta加入战局,中国本土赢家崛起,“凭感觉编程”催生真实用户,还公布“全明星”阵容。

宝玉AI
开源动态8

代码、多模态检索全面登顶SOTA!智源BGE向量模型三连击,并全面开放

检索增强技术在代码及多模态场景作用大,向量模型是关键。智源研究院联合高校研发三款向量模型BGE - Code - v1、BGE - VL - v1.5、BGE - VL - Screenshot,登顶多领域测试基准,已全面开放助力研究与应用。

机器之心
推荐文章8

手工软件工程师的时代已经结束!一位连续创业CTO的判断

连续创业者、Tessi.ai CTO Ben Greene 在访谈中指出,生成式 AI 改变软件工程形态,手工软件工程师时代过去。工程师应转向理解问题、设计系统,具备系统思维、业务理解和与人协作能力,学会“AI 编排”。

InfoQ