「可观测技术」共找到 6413 篇相关文章
GPT-6 Sol和Opus 5.2同时灰测!奥特曼阿莫迪周末刚喊刹车,一上班就踩油门
本文爆料OpenAI和Anthropic同步灰度测试新一代大模型GPT-6 Sol和Claude Opus 5.2,对比了模型性能提升,同时提到OpenAI GPT-5.5即将退役,带来AI大模型领域最新前沿动态。
Harness已过时,OpenAI、腾讯在搞下一个AI爆点RSI
本文解读Theseus Labs发布的RSI行业分析报告,该报告汇总全球72家头部AI团队公开资料,提出RSI五级自主权框架与HCI评估指标,梳理大厂进展与产业落地实践。
AI一天写4.4万行代码却没合并,程序员:AI Coding 真正的瓶颈来了
本文分享腾讯AI原生研发的真实案例,指出AI Coding产能提升后,最大瓶颈已非模型能力,而是现有研发治理体系与人的注意力适配问题,同时预告2026奇点智能技术大会的行业实践分享。
模型一模一样,Token 却相差 70 倍?三项实测揭开 AI 编程工具的成本黑洞
本文通过三项独立基准测试,证实相同AI模型下,不同AI编程智能体框架的Token消耗最高相差70倍,分析了成本差异的核心原因,为企业AI成本控制提供可落地的衡量标准。
国货之光!全球AI存储基准测试MLPerf Storage 3.0结果发布,斩获九项第一|甲子光年
9月1日,MLPerf Storage 3.0基准测试结果发布,XSKY星辰天合旗下MeshFS首次参赛,在并行文件存储赛道获九项第一。该测试覆盖多类负载,可多维度衡量存储系统性能,MeshFS兼顾性能与成本效率。
MiniMax ARR暴涨500%,token暴涨2000%!这就是Agent红利吧
MiniMax最新数据显示,今年8月ARR超8亿美元,较2月增长约5.3倍。2026年上半年收入同比涨283.1%,B端收入占比升至80%。其增长得益于用户增多和用法改变,M3、H3模型表现出色。
长程执行成具身智能必考题,墨奇的答案是Agentic-Native|甲子光年
具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。
不再止步于自然语言!PhiZero让世界模型学会「物理语言」
PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。
DeepSeek正式开源Harness:它终于有了自己的Vibe Coding入口
今晚,DeepSeek 正式发布并开源 DeepSeek Harness(DSH)开发者预览版,它是一套 Agent 运行框架。此前 DeepSeek-V4-Pro 上线,二者结合,Harness 负责将模型能力组织成可工作的 Agent,使 DeepSeek 进入相关竞争。
美国开源被中国甩在身后,套壳创业者更遭惨烈清算!OpenRouter CEO:天天乱用高价AI的员工要小心了
顶级科技播客20VC访谈OpenRouter联合创始人兼CEO Alex Atallah。他指出美国开源大模型落后中国,企业怕依赖巨头,AI时代员工成本应动态化,还探讨了模型生态、路由技术等行业热点。