模式化推理」共找到 3489 篇相关文章

算法论文8

LLM「拒绝回答」难题有救了!最新研究让AI学会人情世故 | COLM'25

最新研究发现模型规模和通用语言能力与处理敏感内容判断能力无直接关联,开源模型表现不错。通过提出的训练方法,在非推理推理型模型上缓解过度拒绝问题,提升AI实用性和可靠性。

新智元
算法论文8

最大的开源GraphRag:知识图谱完全自主构建|港科大&华为

香港科技大学KnowComp实验室与香港华为理论部提出AutoSchemaKG框架,可自主构建知识图谱,无需预定义模式。该系统利用大模型提取知识三元组并归纳模式,构建了ATLAS系列知识图谱,经测试表现优异。

量子位
开源动态8

单目3DGS迎来突破:影石开源UniSHARP实现全相机适配

影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。

机器之心
新闻资讯7

“开源已死”?怕被 OpenAI 和 Mythos 把代码挖成筛子,4 万 Star 项目突然闭源!

近日,开源初创公司 Cal 宣布将旗舰开源项目转为闭源,因无力应对 AI 攻击开源代码风险。其联合创始人称,现有开源安全模式难以抵御 AI 攻击。此举引发开发者质疑,也凸显 AI 对开源模式的冲击。

AI前线
新闻资讯7

狙击Gemini 3!OpenAI发布GPT-5.1-Codex-Max

Gemini 3力压全场,OpenAI发布GPT-5.1-Codex-Max应对。它突破上下文窗口限制,能连续工作超24小时,在METR达新SOTA,推理更快,还推出xhigh推理力度选项,已支持与多种工具结合。

量子位
算法论文8

谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分

纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师级水平差距明显。

机器之心
推荐文章8

相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么

文章围绕 Agent Protocol 展开,指出框架更迭但生产级 Agent 系统问题不变。以 Agent Protocol 为主线拆分 Agent Runtime,探讨其核心、稳定对象、执行模型等,还对比各框架在多维度的表现并给出设计建议。

阿里云开发者
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细评估’闭环训练,配套结构评测基准,让模型在文遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
产品应用8

解析天花板?TextIn xParse如何为RAG打造「零损耗」知识管道

在AI应用发展中,LLM与RAG系统成核心引擎,但项目落地时模型表现常难达预期,根源在于文档解析质量。TextIn xParse能为RAG打造‘零损耗’知识管道,本文从多方面对其解析能力进行了解读。

深度学习自然语言处理
开源动态8

OpenAI未公开的o3「用图思考」技术,被小红书、西安交大尝试实现了

OpenAI推出的o3推理模型打破传统文字思维链边界,实现图像融入推理过程。小红书与西安交大联合构建多模态深度思考模型DeepEyes,尝试实现类似能力,还开源技术细节,在多任务中表现出色。

机器之心