生成式模型」共找到 8914 篇相关文章

新闻资讯7

模型之后,AI 开始“自己动手”了

生成AI到Agentic AI,互联网从“信息获取”转向“任务完成”。全球科技巨头抢滩智能体,国内腾讯云升级智能体开发平台。腾讯吴运声表示,技术与业务需求双轮驱动其发展,还分享了应对落地挑战的办法。

AI科技大本营
算法论文7

一篇多模态大模型推理技术最新综述

华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。

PaperAgent
产品应用7

教你用 Lovart 生成超炫 PPT 视频封面

受海外老哥启发,探索出用 Lovart 生成动态 PPT 背景的提示词,提示词放评论区。

歸藏的AI工具箱
推荐文章8

吴恩达来信:当防护机制出问题时

本周,闭源模型用户意外发动网络攻击,闭源模型因防护机制无法协助防御,开放模型 GLM 5.2 却助力应对。吴恩达认为应重视模型使用的责任,开放模型能让技术更透明安全。

DeeplearningAI
算法论文7

Paper2Video:学术研究论文讲解视频自动生成

学术演示视频制作耗力,Show Lab提出Paper2Video基准数据集和PaperTalker多智能体框架,可从学术论文自动生成演示视频。还引入定制化评价指标,衡量学术演示视频效果。

带你学AI
开源动态7

毫秒响应延迟!开源统一语音对话模型Voila

Voila是开源统一语音对话模型,能以自发、实时且有情感的方与人类互动。它采用全新端到端架构,响应延迟仅195毫秒,支持超百万种预构建声音,适用于多种语音应用。

带你学AI
开源动态8

Qwen3新成员:Embedding系列模型登场!

今天正发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3多语言理解优势。在多项基准测试表现卓越,已在多平台开源,有卓越泛化性、灵活架构与多语言支持等特点。

通义千问Qwen
开源动态7

从文心开源谈起,论大模型发展新生态

6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现预训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。

AI科技大本营
新闻资讯8

斯坦福年度结论:中美大模型已没差距

斯坦福HAI《2026年AI指数报告》指出,中美AI模型性能差距基本消除,AI能力加速发展且普及快,但也存在安全基准滞后等问题。报告含15个主要结论,已成为业界重要参考。

量子位
算法论文8

Anthropic:大模型开始意识到自己在想什么!

Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

深度学习自然语言处理