「Seedream 4.0」共找到 2301 篇相关文章
微信技术架构部斩获CVPR 2025大赛冠军,攻克AI图文匹配评估难题
微信WXG技术架构部IH-VQA团队在CVPR2025大赛夺冠,首创iMatch图文匹配质量评估方案。文中介绍赛事背景、规则,团队通过双模型驱动等策略获胜,还构建iMatch-Benchmark评估主流T2I模型。
谢赛宁苏昊CVPR25获奖!华人博士王建元一作拿下最佳论文
CVPR 2025奖项揭晓,谢赛宁、苏昊获青年学者奖。最佳论文《VGGT: Visual Geometry Grounded Transformer》由王建元一作。还介绍了最佳学生论文及4篇荣誉提名论文的亮点与应用前景。
阿里又放大招!一句话,造一个能走进去的世界
阿里上线HappyOyster 1.0世界模型,一句话生成可实时探索、交互的开放世界。它与文生视频不同,能让用户参与体验。该模型有世界探索和实时导演两大功能,技术优势显著,应用场景广泛。
引爆千亿市场!杭州AI再出王炸:刷新自研天花板,“三甲专家大脑”装进14亿人口袋
在2026智诊科技AI发布会上,智诊科技完成蜕变。其发布的Wise MemOS 2.0打破传统局限,WiseDiag V2有深度多模态联合分析能力,WiseResearch让AI告别幻觉,“好伴AI”下放技术,服务大众。
Claude Code迎来大更新:Agent能力增强
Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。
谷歌Gemini Diffusion:1500 token/秒,快如闪电!
谷歌DeepMind在I/O 2025上推出实验性模型Gemini Diffusion,将扩散技术用于文本生成。它每秒能生成约1500个token,比Gemini 2.0 Flash - Lite快5倍,具备高响应速度、文本连贯性等优势。
李飞飞刚立规矩才13天,国产卡上「真物理」就来了!
李飞飞为「世界模型」立规矩13天后,中国「草根」团队Mogo推出全球首个具备高动态物理交互能力的世界模型Magpie 1.0,在国产芯片上实现超10分钟物理一致性,开辟全新技术路径。
同一天两件大事!小模型直接掀翻千亿参数,走向效率为王
5月13日AI圈有两件大事,何恺明团队发布语言模型ELF,面壁智能开源MiniCPM-V 4.6。二者显示AI正从‘堆算力’转向‘省算力’,拉开AI轻量化浪潮序幕,未来小模型或成关注方向。
刚刚,阿里「欢乐马」正式上线,抢先实测这匹「黑马」
4月27日,阿里ATH团队上线视频生成模型HappyHorse 1.0。它依托多模态架构,音视频创作编辑一体,价格实惠。支持文生、图生、多图参考生视频,视频编辑功能强大,能精准替换主体、添加元素、改变风格。
Meta 发布 Docusaurus 3.9,新增 AI 搜索功能
近日 Meta 发布 Docusaurus 3.9,重点更新有现代化运行时环境、增强 AI 搜索能力、提升国际化灵活性。如支持 DocSearch v4 让用户对话查内容,提高 Node.js 最低要求,改进 i18n 配置等。