「AI视觉内容生成」共找到 10443 篇相关文章

开源动态7

Headroom:Netflix 工程师开源的上下文压缩工具,省 token 还是烧 token?

Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent的上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。

AI工程化
新闻资讯7

ICLR 2026史上最严新规:论文用LLM不报,直接拒稿!

ICLR 2026官方组委会发布「LLM使用新政」,规定用LLM写论文、审稿须明示,作者和审稿人对内容负全责,违规者直接拒稿。还举例说明LLM在不同场景使用的后果。

新智元
产品应用9

我用 GPT 6 Astra 做了一个 3D 版的《桃花源记》(文中含提示词)

作者宝玉分享借助GPT 6 Astra与Codex制作可交互3D版《桃花源记》的完整过程,公开可复用提示词模板,提供成品在线体验,分享AI生成交互式内容的实战心得。

宝玉AI
推荐文章8

大型语言模型正在掏空和填满你的钱包

人工智能改变赚钱和花钱方式,生成式AI每年或为全球经济增2.6 - 4.4万亿美元。文章介绍LLM在多领域应用,如客服降成本、内容创作提效率等,企业应积极拥抱技术革命。

AIGC开放社区
开源动态8

手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源

面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。

AIGC开放社区
新闻资讯7

对话阶跃星辰段楠:“我们可能正触及 Diffusion 能力上限”

阶跃星辰段楠指出当前视频生成技术或触天花板,真正有深度理解能力的模型尚待突破。他预测未来1 - 2年视觉领域基础模型有望出现,还分享视频生成及多模态AI未来核心洞察。

AI科技大本营
开源动态8

字节开源GUI Agent登顶GitHub热榜,豆包手机核心技术突破26k Star

字节开源的豆包手机核心支撑GUI Agent模型UI - TARS登顶GitHub热榜,突破26k Star。它是多模态AI智能体,纯视觉驱动,部署简单,历经多轮迭代,成为热门开源多模态Agent。

量子位
产品应用7

腾讯无极低代码平台打开MCP之外的新思路:多模态聊天

腾讯无极低代码平台提出‘前端多模态智能’概念,让AI输出内容更多样,可嵌入交互页面片。它还给出四步配置法实现‘多模态聊天’,与MCP形成互补,能增强信息交互和用户掌控感。

腾讯技术工程
开源动态8

41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码

智谱基于GLM - 4.5打造的开源多模态视觉推理模型GLM - 4.5V,在42个公开榜单中41项夺得SOTA。其功能丰富,玩法升级,还为企业与开发者提供高性价比方案,是100B参数级SOTA标杆。

新智元
推荐文章8

每个token都在亏钱,但ARR9个月破亿!从烧光现金、裁掉一半员工到反杀Cursor,Replit CEO曝一年内如何极限翻盘

2024年初到2025年9个月内,Replit的ARR从不到1000万美元突破1亿美元。其增长基于系统性战略,从基础设施整合发力。创始人分享发展历程,还谈到AI编程趋势及产品边界等内容。

AI前线