「AI图像模型」共找到 13744 篇相关文章
大模型终于通关《宝可梦蓝》!网友:Gemini 2.5 Pro酷爆了
Gemini 2.5 Pro在直播中通关《宝可梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝可梦对大模型的挑战,谷歌将继续探索,网友提议用通关宝可梦测试大模型 。
谷歌打响教育第一枪!发布50+项免费AI教育功能,彻底改变课堂!
Google for Education官宣更新,将以Gemini为首的AI工具免费提供给全球教育工作者,集成到Google Classroom和ChromeOS。有Gemini in Classroom等功能,还通过教师主导解决安全担忧,上线数据分析工具。
全国首部“AI生成内容合规”标准,现公开征集起草单位和个人
随着AIGC转向产业落地,监管对生成内容管控成趋势,AI生成内容风险也凸显。全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》应运而生,现公开征集起草单位和个人。
强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”
在大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。
3年、1万人,快手技术团队首次系统披露AI研发范式升级历程
快手首次系统性披露自2023年以来的AI研发范式升级历程。其研发效能演进分三阶段,从平台化到智能化,虽遇个人提效难传导至组织提效的问题,最终仍找到提升需求端到端交付效率的路径。
马斯克视频生成模型首次交卷!电影级运镜+音效,免费可玩
xAI的“迄今为止最强大的视频音频生成模型”Grok Imagine 1.0正式全面上线。该模型支持文生视频、图生视频,音频效果出色,还擅长日常趣味创作。其在视频生成和剪辑性能领先,官网可免费玩。
基于Agent的SGLang Diffusion Kernel优化实践:Qwen-Image、FLUX.2和视频模型
本文记录基于Agent完成Qwen-Image、FLUX.2、Wan和SANA Video优化的过程,包括定位问题、写Kernel及遇到的坑。介绍SGLang Diffusion Kernel结构,分析数值敏感原因,展示各模型优化实践、无收益实验及验证流程。
复旦上线音视频模型新裁判:一万组数据对齐人类审美
现有音视频生成领域的奖励模型多依赖局部指标打分,不符合人类整体审美感受,易让模型“刷高分”却未真正提升生成质量。复旦大学团队推出VA-Judger,基于一万组人类偏好数据训练,可从整体维度判断生成质量,对齐人类审美。
今天,AI内容新规正式实施,这次不注意是真的会违法。
9月1日,《人工智能生成合成内容标识办法》及配套国标正式执行。其旨在解决AI虚假内容充斥问题,规定AI内容需打显式和隐式标识,对专业环节友好、公开传播严厉,还对相关方提出不同要求。
当AI走进Second Half:真正的问题、价值与生态是什么?|甲子光年
本文是甲子光年年终盛典巅峰对话实录,探讨AI下半场问题。嘉宾们认为技术上未到下半场,但应用层面已至。大家围绕重新定义问题、评估真实价值、重构产业生态展开交流,分享见解与经验。