「Gemini 3.0」共找到 3053 篇相关文章
刚刚,阿里「欢乐马」正式上线,抢先实测这匹「黑马」
4月27日,阿里ATH团队上线视频生成模型HappyHorse 1.0。它依托多模态架构,音视频创作编辑一体,价格实惠。支持文生、图生、多图参考生视频,视频编辑功能强大,能精准替换主体、添加元素、改变风格。
Bun 推出内置数据库客户端与零配置前端开发
Bun 发布 1.3 版本,是迄今最大更新,实现全栈开发,推出统一数据库 API 并提升性能。引入零配置前端开发模式,有内置 Redis 客户端,社区反响不一,还扩展包管理功能,性能提升显著。
国产大模型高考出分了:裸分683,选清华还是北大?
字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。
字节开源版Seedance发布,超越Sora 2!
字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章通过分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在大规模 AI 训练中的表现。介绍三类训练负载及新的 Checkpointing 负载,分析共享文件系统类别,给出比较视角,解读各负载测试结果并总结选型要点。
谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag
在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有低延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。
老黄入局吃龙虾!英伟达发布最强开源Agent推理模型
英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐量大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放全参数权重等。
比修驴蹄还魔性!谷歌这7段纸片动画,看完焦虑没了,第2支直接封神
全球网友爱刷解压视频,谷歌Gemini下场做带提示词的解压视频。它推出7段纸艺动画,包括火烈鸟起舞、圣托里尼落日等,靠高精准提示生成等打造,拓展想象边界,是通往美学与治愈的桥梁。
Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!
Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。
一天斩获2.5k星星!首个可以「让AI直接画CAD」的开源项目来了
新开源项目text - to - cad很猛,只需把需求告诉AI,它就能生成可编辑3D模型、导出文件,还能预检。支持多格式,有几何引用等特点,一天获2.5k星。