「混元图像3.0」共找到 3106 篇相关文章
英伟达员工晒年终奖,黄仁勋霸气签皮衣;Moltbook爆火:当AI有了自己的社交网络;又一“95后”清华天才科学家庞天宇加盟腾讯混元 | Q资讯
本文汇总 AI 行业热点,有 Moltbook 成 AI 社交平台且爆火;OpenAI 两款产品用户流失;亚马逊、Meta 裁员;英伟达年终奖、合作协议情况;阿里发布千问新模型;还有大厂春节发红包竞争,DeepSeek 布局新领域等消息。
奥特曼怕了!GPT-5.5「大蒜」决战谷歌,红色警报紧急拉响
三年前ChatGPT让谷歌恐惧,如今OpenAI被谷歌逼得拉响‘红色警报’。OpenAI计划发布新推理模型,‘Garlic’预训练有突破,还启动下一代模型。OpenAI调整策略,聚焦提升ChatGPT体验。
AI短剧成了!LibTV-seedance2支持“真人模式”:一手实测,视频闪电直出,效果炸裂
LibTV首发支持Seedance 2.0真人生成视频功能,操作简单严谨。真人出镜可用于虚拟主播、数字分身、角色替换等场景。该工具工作流高效,接入主流模型,价格有优惠。
Helidon 引入 Agent 能力,Java 框架开始内建 AI 编排
Oracle 发布 Helidon 4.4.0 版本,对齐 OpenJDK 发布节奏,纳入 Java Verified Portfolio。引入新核心能力、Helidon JSON 库,还增强与 LangChain4j 集成,支持智能体编排。
无需 OCR 就能从各类文档中提取结构化信息的本地化开源工具docext
docext是无需OCR的本地化开源工具,能从发票、护照等文档图像提取结构化信息。智能文档处理排行榜评估VLMs在多任务表现,docext有灵活提取、表格提取等功能。
OpenAI史上最快模型降临,每秒1000Token!代码从此「炸出来」
OpenAI发布GPT-5.3-Codex-Spark,它是专为实时编程设计的超高速模型,生成速度超每秒1000个token,联手Cerebras硬件,重写底座提升性能,在多项测试表现强,ChatGPT Pro用户可尝鲜。
Anthropic 定义了标准,我们造了库:为什么 2026 是 Agent Skills 元年
2025 年 12 月 18 日,Anthropic 将 Agent Skills 发布为跨平台开放标准,终结了 Agent 开发混乱。特赞团队推出 `skill0` 响应标准,其诞生源于企业业务需求,2026 年 Agent 开发将质变。
奥特曼「红色警戒」5个月后,GPT Image 2屠榜,断层领先反杀谷歌
被Google按了半年头,OpenAI祭出反杀。GPT Image 2上线12小时登顶Arena文生图榜,领先Nano Banana 2达241分。它是从零重构的通用模型,具备原生思考能力,或改写图像生成赛道规则。
清华传奇姚顺宇立功!全新Gemini一夜血洗编程,全球仅7人能赢它
谷歌Gemini 3 Deep Think重磅升级,几乎刷爆全领域SOTA。编程界冲入Codeforces人类TOP 10,人类最后考试等测试也表现优异。还能解决科研工程难题,实测物理模拟能力强,给OpenAI带来压力。
17岁高中生做出AI神器:看一下视网膜,就能识别自闭症和多动症
美国17岁高中生Edward Kang开发AI工具RetinaMind,通过视网膜图像识别自闭症和多动症,准确率达89%,还能分析疾病基因机制。该成果助他获2026年Regeneron科学天才奖二等奖及奖金。