「高分辨率图像」共找到 2262 篇相关文章
突发!xAI联创杨格过劳病离职,给马斯克干活压力山大
xAI联创杨格因长期高强度工作患莱姆病离职。此前已有多位核心成员离开。马斯克强调速度的管理风格使员工压力大,其公司高管更迭率高,不过也有人认为这能筛选出能力强的成员。
亏到发疯!AI编程独角兽年入2亿8,结果用户越多亏得越狠
TechCrunch调查发现,AI编程公司虽收入和估值高,但普遍亏损。其运作成本高,大语言模型调用费占大头,用户越多成本越高,且市场竞争激烈。公司尝试自研模型、被收购、降价、提价等方法扭亏。
从 Serverless 到 Agent:Cube 系统的一些设计思考
本文从 Serverless 面临的挑战出发,介绍 Cube 系统设计,包括分布式调度、资源池化等。还探讨其在 Agent 场景应用,如极速代码执行、高并发 Agentic RL 等,最后展望向行业开源,助力 Agent Infra 发展。
The Batch:924|GPT-5.4:性能更高,价格也更高
OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。
The Batch: 920 | Nano Banana 2 在性能/价格比方面实现提升
Google发布Nano Banana 2(正式名称Gemini 3.1 Flash Image),是图像生成系统。它速度快约4倍、成本减半,支持多功能,在多个排行榜中位列前三,以低价接近文字 - 图片排行榜领先位置。
The Batch: 931 | 统一视觉媒体的单一分词器
Apple团队开发多维分词器AToken,可将图像、视频、3D对象映射到共享token空间,统一处理视觉媒体。它由预训练编码器和解码器组成,经多阶段训练,在多任务上达或接近先进水平,为视觉模型带来通用性。
蚂蚁多模态统一框架Ming-Omni:能看懂世界、会说话、还能画画
文章介绍蚂蚁多模态统一框架Ming - Omni,它可统一处理图像、文本等多模态数据。该框架解决了多模态训练中模态表示差异、收敛速度不一致等问题,采用分阶段预训练,能用于图像、音频生成及多模态交互。
时间会证明光的
市场曾质疑AI资本开支高增长的持续性,如今随着头部模型公司ARR非线性爆发式增长,AI商业正向循环打通。在AI硬件产业链中,光互联是国内厂商全球参与度最高、份额最稳固的环节,正迎来最好时代。
「香蕉革命」首揭秘!谷歌疯狂工程师死磕文字渲染,竟意外炼出最强模型
谷歌最新图像模型nano banana横空出世,能融合图片、理解地理等结构,实现多轮创作。它凭借Gemini知识与交错生成技术,重塑AI图像生成边界。谷歌团队揭秘其技术,还谈及未来发展方向。
突发,OpenAI八年元老离职!
2026年OpenAI爆发罕见离职潮,IPO前似在经历大清洗。先是元老级高管Brad Lightcap官宣出走,后AI伦理负责人Chloé Bakalar也离职,此前还有多批产品、运营、安全等部门高管出局。