「AI可观测性」共找到 11646 篇相关文章
AI的七窍打通了!谷歌发布Gemini Embedding 2原生多模态嵌入模型
谷歌发布Gemini Embedding 2新型基础架构,将文字、图像等数据整合到统一维度,终结旧工作流。该系统赋予机器五维感知,建立跨媒介沟通语言,提升运行效率,在多场景有应用潜力。
最新研究!大模型“角色扮演”无效了?
沃顿商学院研究测试6个主流AI模型,进行超25000次测试,发现告诉AI扮演专家角色,不会让其回答更准确,反向设定‘低知识’角色有时表现更好,角色扮演不是提高准确性的万能钥匙。
11位顶尖数学家发了篇没结果的论文,陶哲轩推荐都关注一下
11位顶尖数学家发起First Proof实验,设计10道研究级数学问题,检验AI独立解决问题的能力。陶哲轩认为实验有趣,当前AI一次性提示难解题,截止期限前成果值得关注。
Meta新任副总裁:Manus创始人肖弘,90后
Meta正式收购AI智能体初创公司Manus,创始人肖弘出任Meta副总裁,交易金额或达数十亿美元。Manus技术强、营收高,其加入将助Meta打造AI产品,收购具象征意义。
昨夜,Claude智能体压垮华尔街,近万亿刀市值蒸发
昨夜,Anthropic发布新一代AI工具「Claude Cowork」及11款职能插件,被视为AI向「独立员工」跨越的分水岭,动摇SaaS软件根基,引发华尔街恐慌,众多软件公司股票遭抛售。
谷歌开放世界模型一夜刷屏,AI游戏门槛归零时刻来了?
谷歌DeepMind开放世界模型Genie 3的实验性研究原型「Project Genie」,由Genie 3、Nano Banana Pro和Gemini提供技术支撑,有世界草绘、探索、重混三大玩法,但Genie 3仍处早期需改进。
Claude Sonnet 4 API 支持百万上下文:解锁真正的生产级AI工程
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量是之前5倍。长上下文支持已向部分客户公测,将推给更多用户。该功能已在亚马逊Bedrock公测,也将登陆Google Cloud。还介绍了用例、定价及早期用户好评。
ChatGPT正式上线广告主平台,AI产品从今天开始走向分裂。
今日凌晨,OpenAI更新ChatGPT,上线非推理模型GPT - 5.5 Instant,还官宣向企业主全量上线广告平台。此前广告已在部分地区测试,付费和未成年用户无广告,免费用户可选择关闭但功能受限。投放端向美企开放,出价高,这或成AI产品宿命。
不增加人手,项目效率飙升45%,OpenAI公开了一套AI实战经验
OpenAI公开基于大语言模型和专属Skill包的开源仓库维护方法论,将重复工作自动化,使项目代码合并吞吐量飙升45%。该方法由AGENTS.md、Skill包和GitHub Actions构成,还涉及任务分配、验证策略等。
迈向可编程观测:在GPU Kernel中构建类eBPF风格的性能探针
文章从CUDA基础讲起,以矩阵乘法为例介绍性能调优,再到PTX汇编知识,最后引入Neutrino框架构建可编程GPU性能探针。展示了GPU Kernel性能分析从宏观到微观的技术演进,提供新分析视角。