可观测2.0」共找到 5863 篇相关文章

新闻资讯7

Claude for Chrome来了!作为浏览器扩展程序直接使用

Anthropic发布浏览器agent Claude for Chrome,作Chrome扩展程序使用,能设日历、回邮件等。目前仅向1000名Max套餐用户开放,因使用浏览器的AI有安全挑战。AI浏览器成巨头争夺战场。

量子位
开源动态8

刚刚,DeepSeek开源OCR 2,首创Qwen编码的「双流架构」

年底 DeepSeek 开源新模型 DeepSeek - OCR 2,首创双流注意力架构,model&paper 一同发布。它重构视觉编码器,采用三阶段训练流程,在 OmniDocBench v1.5 评测及生产环境验证中表现良好。

PaperAgent
新闻资讯7

GPT Image 2研究科学家陈博远:我在OpenAI修中文

GPT Image 2发布引发AI圈震动,主力训练者陈博远分享幕后故事。他和奥特曼同台主持,修好中文渲染,给模型起代号“布基胶带”,还设计多种“彩蛋级”测试,抖出官网图片幕后花絮。

量子位
算法论文7

解释性杀疯了!结合机器学习,发顶会轻轻松松!

在机器学习领域,模型解释性愈发重要。结合XAI技术能提升模型透明度与信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。

机器学习AI算法工程
新闻资讯7

GPT-5.2已上线24小时:差评如潮!

OpenAI 十周年推出号称强大的 GPT - 5.2,却差评如潮。它在 SimpleBench 测试结果不佳,回答不稳定,编程和艺术创作效果差,情商低、不通人性,审查和安全拒绝机制也饱受诟病。

机器之心
新闻资讯7

Gemini 3「开眼」像素级操控!谷歌回应DeepSeek-OCR2

Google DeepMind为Gemini 3 Flash推出Agentic Vision,让模型主动编代码操控图像,性能提升5% - 10%。该能力已上线,谷歌还计划扩展功能。这或许是受DeepSeek-OCR2刺激,两者技术路线不同。

新智元
产品应用8

实测GPT-image-2,设计行业真的完蛋了吗?

GPT-image-2正式上线,实测效果震撼,在文字渲染、世界知识、修改精准度和审美方面有显著进步。它让画图变得不再稀缺,冲击设计行业,但设计核心是思考,画图员时代结束,设计师时代刚开始。

数字生命卡兹克
产品应用7

谷歌发布 Gemma Scope 2,深化对 LLM 行为的理解

Gemma Scope 2 是谷歌推出的解释 Gemini 3 模型行为的工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先的 Gemma Scope,还引入针对聊天机器人的分析工具,已发布权重。

InfoQ
算法论文8

首个学习姿态对齐的视频扩散模型!StableAnimator++

当前人像动画扩散模型在人物身份一致性上表现不佳,复旦大学联合多团队提出StableAnimator++,它是首个学习姿态对齐的视频扩散模型,能生成自然保真的人物动画,还在保持人脸一致性上做了改进。

带你学AI
推荐文章8

AI-Native 的 Infra 演化路线:L0 到 L5

文章来自 Agent Infra 创业者 Hang Huang,以其产品开发实践经验,分享 Agent Infra 机会。指出 AI 编程生产力跃迁,从写代码到掌控软件全生命周期是趋势,还提出 L0 - L5 模型描述 AI-Native Infra 演化路径。

海外独角兽