o4模型」共找到 8441 篇相关文章

推荐文章7

LLM遇上表格:4类表示、5大任务、3大机会

文章指出LLM处理表格有任务单一、输入复杂易崩、表示不统一痛点,介绍4种表格输入表示法、5大任务,还发现任务复杂度、输入复杂度及表示统一方面存在新研究机会。

PaperAgent
产品应用8

基于AI大模型的故障诊断与根因分析落地实现

文章围绕基于AI大模型的故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决的运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。

阿里云开发者
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
新闻资讯8

GPT‑5深夜发布:模型之战结束,Agent之战开始!

昨晚,炒作一月的GPT - 5正式发布,标志原生Agent时代到来。体验显示其压低幻觉、提升指令遵循与推理能力。文中还对比了GPT - 5、Gemini、Claude等模型在不同场景表现,指出御三家路线分化及三条反常识判断。

探索AGI
新闻资讯7

当AI开始过度思考「hey」这个字…

两张对话截图展现语言模型缺陷,用户发简单问候,模型过度分析,从问候语正式程度到表情符号语义权重,这种过度分析让对话不自然,错过人类交流重点。

AI工程化
开源动态9

SGLang 某些模型的 CUDA Graph 为什么会有上百条 decode cuda stream?

本文分析SGLang运行DeepSeek-V4.1时,CUDA Graph出现上百条decode CUDA流的问题成因,介绍开源PR的修复方案,分享了压缩profiler显示行数的实用脚本方法。

GiantPandaLLM
开源动态8

谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!

在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是高精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。

开源星探
开源动态8

HexStrike代理:让大模型继承专家经验,显著提升渗透测试效率

HexStrike是开源渗透测试工具,以MCP为底座。其核心智能组件IntelligentDecisionEngine是专家系统,将安全专家经验规则化,通过知识库和算法提供工具选择和参数优化,提升渗透测试效率。

AI与安全
新闻资讯7

DeepSeek V3.1更新「最终版」!下一次是V4/R2了???

DeepSeek-V3.1更新至DeepSeek-V3.1-Terminus版本,修复了“极你太美”等bug,缓解中英文混杂等情况,优化了Code Agent与Search Agent表现。评测显示输出更稳定,但编程竞赛分数下降引质疑,版本名引发对后续版本猜测。

量子位
产品应用7

Gemini 3.1 Flash-Lite Preview发布:Google完成AI模型分层布局

Google发布Gemini 3.1 Flash-Lite Preview,针对企业和开发者场景优化,速度快,有‘思考级别’功能。基准测试表现不错,价格比Claude 4.5 Haiku便宜,但开发者社区反应复杂,面临市场定位问题。

AI工程化