「GPT - 5.2」共找到 3556 篇相关文章
奥特曼神秘晚宴讲话曝出!OpenAI的CEO或将是个AI,Chrome我也想买
OpenAI的奥特曼在晚宴勾勒宏大愿景,要颠覆搜索、社交等领域,斥资数万亿打造数据中心和新硬件,还探索脑机接口。他认为AI潜力大但处于泡沫期,也谈到GPT-5、算力融资等问题。
Auto Research最后一块拼图,Frontier-Eng Bench登场,在工程闭环里死磕最优
Einsia AI旗下Navers Lab论文Frontier - Eng推出新评测范式Generative Optimization,搭硬核评测系统,覆盖47个横跨5大工程方向的任务。评测多种模型,结果显示gpt 5.4最稳健,但距资深工程师水平尚远。
DeepSeek V4永久降价!缓存命中再打1折,实测编程成本骤降83%
DeepSeek两天连续两次降价,输入输出2.5折,命中缓存输入折上再1折且无时限。实测编程成本骤降83%,此前31.73元,打折后只需5.34元。其曾引发价格战,此次对海外用户冲击更大。
谷歌认领最强AI版Photoshop!现在人人可用,效果确实强悍
谷歌认领神秘图像编辑模型nano - banana,即Gemini 2.5 Flash Image。它可免费在Gemini和Google AI Studio使用,API收费。该模型图像编辑能力出色,能合并图片、实现2D到3D转换等,此前爆火却无官方文档。
AI看不到的爱心,成了最棒的AI检测器。
作者以漂浮爱心图检测AI,Gemini 2.5 Pro、GPT - 5等模型均失败。又用噪点鹿视频测试,AI准确率为0%。原因是AI是空间王者、时间瞎子,无“共同命运法则”视觉系统,存在时间盲视。
自写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」
在全自动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。
视觉+语言+动作!超强具身“训练宝典” EmbRACE-3K
视觉 - 语言模型在具身环境中表现有局限,港大推出 EmbRACE - 3K 数据集应对。它含 3000 多个任务、2.6 万个决策步骤,有细致多模态注释。团队用其微调 Qwen2.5 - VL - 7B 模型,还建立新基准评估多个模型。
Sora 2 即将发布?
OpenAI官方发预热推文,暗示Sora 2即将发布,众人纷纷猜测。有人认为它将超越Veo3,也有人保持冷静。此外,还爆料OpenAI正打造AI视频媒体平台,大家看法不一,有人期待,有人焦虑。
DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini
DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码器,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码器」可行性。
OpenAI重新开源!深夜连发两个推理模型,o4-mini水平,笔记本、手机可跑
OpenAI 自 GPT - 2 后重新开源,此次连发两个推理模型 gpt - oss - 120b 和 gpt - oss - 20b。它们性能达 o4 - mini 水平,可在笔记本、手机运行,有宽松许可等亮点,在多测试中表现出色。