可观测2.0」共找到 5953 篇相关文章

产品应用7

太牛了~~复杂表格Cell合并、跨页拼接,中文领域96%,甩MonkeyOCR 20%

在PDF文档解析领域,复杂表格解析是难题。今天分享的OCRFlux是基于qwen2.5vl - 3B模型微调的解决方案,有单页解析和跨页段落/表格合并等创新点,测试得分超96%,远超MonkeyOCR等。

PaperAgent
开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
推荐文章7

深入解析|Cursor编程实践经验分享

文章结合近两个月实践,分享Cursor编程经验,探讨其适用场景与问题。介绍使用方法,如标准Prompt、Rules等,还提及MCP工具及Cursor不足,对比DeepResearch等平台,最后介绍AutoGPT、Claude4.0等技术。

阿里云开发者
推荐文章9

Harness已过时,OpenAI、腾讯在搞下一个AI爆点RSI

本文解读Theseus Labs发布的RSI行业分析报告,该报告汇总全球72家头部AI团队公开资料,提出RSI五级自主权框架与HCI评估指标,梳理大厂进展与产业落地实践。

CourseAI
推荐文章8

对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打的有来有回

本文实测免费AI Coding Agent AgnesCode搭配Agnes 3.0 Flash,对比付费Codex组合在DeepSeek-V3底层算子多芯片优化任务中的表现,验证免费Agent胜任底层AI工程的能力,分享实测数据与行业洞察。

AI科技评论
开源动态8

深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?

昨天,Meta发布约30B参数的多模态Agent模型Muse Glimmer,支持128K级上下文。它采用Apache 2.0证开放,有量化版本等。其技术设计围绕显存、上下文管理等问题展开,在多方面做了取舍。

AI科技评论
产品应用7

PDL 在 SGLang Kimi K3 中的应用

文章介绍 PDL 在 SGLang Kimi K3 中的应用,K3 内核优化接入 PDL 以缩短相邻内核间隙。分析 PDL 原理、在 bs=1 decode 中解决的问题,阐述计算链和通信链上的应用,还提及性能数据和实现问题。

GiantPandaLLM
开源动态8

MiniCPM-o 4.5 技术报告发布:全双工全模态 API 开放,RTX5070 即实时运行

面壁智能等发布 MiniCPM-o 4.5 技术报告,开放全双工全模态 API。该模型 9B 参数,RTX5070 实时运行,下载量超 25 万。报告披露 Omni - Flow 框架,模型性能强,还能催生新应用。

AI前线
算法论文8

永别了,背公式时代!波兰物理学家用一个算子统一数学

2026年4月,波兰雅盖隆大学物理学家安杰伊·奥德尔齐沃莱克发表论文,提出算子eml(x,y) = eˣ − ln(y),证明不断嵌套此算子推导出科学计算器上每个按键对应的函数,引发数学界震动。

新智元
算法论文8

Kimi新架构让马斯克叹服!17岁高中生作者一战成名

17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。

量子位