推理框架」共找到 3364 篇相关文章

7

国产大模型高考出分了:裸分683,选清华还是北大?

字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。

量子位
开源动态7

OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型

音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。

带你学AI
算法论文8

Google新研究:降低大模型幻觉的全新视角——充分上下文!

谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。

AI工程化
算法论文7

全面评估多模态模型视频OCR能力,Gemini 准确率仅73.7%

MME - VideoOCR团队评估多模态大模型(MLLM)视频OCR能力。构建精细任务体系和高质量数据集,评测18个主流MLLM。即便如Gemini - 2.5 Pro,准确率仅73.7%,暴露出MLLM在视频OCR领域能力局限。

量子位
开源动态8

一个LoRA实现GPT-4o级图像编辑!浙大哈佛新模型冲上Hugging Face榜二

随着Gemini、GPT - 4o等把基于文本的图像编辑推向高峰,提高性能常需大量数据和大参数量模型。而浙大哈佛团队提出ICEdit,用少量数据和参数实现高质量图像编辑,媲美甚至超越商业大模型。

新智元
新闻资讯7

英伟达CEO黄仁勋:错失中国AI市场,是美国巨大损失

在“Knowledge 2025”大会上,英伟达CEO黄仁勋接受CNBC专访,称中国AI市场未来2 - 3年达500亿美元,错过是美国巨大损失。还提到AI影响、与ServiceNow合作成果等,英伟达股价有波动,财报受关注。

AIGC开放社区
产品应用7

评论送书 | 我用扣子(Coze),五分钟搭建出一个客服自动应答智能体

文章以设计‘产品功能咨询智能体’为例,介绍用扣子平台搭建客服自动应答智能体的全过程,包括创建项目、工作流、搭建流程框架及试运行优化,还推荐了相关书籍。

AIGC开放社区
开源动态8

1.9K Star!给 DeepSeek Harness 装上侧边工作台,文件、终端、Git、浏览器、插件一屏搞定!

DeepSeek Harness 是 AI Agent 运行框架,自由度高但默认 Web UI 操作不便。社区插件 DSH - better - sidebar 迅速出圈,装了侧边工作台,整合多样工具,更新勤,适合折腾 DSH 的人。

开源星探
新闻资讯8

前沿模型被曝年度重大漏洞:加密思维链可被轻松提取,GPT,Claude,Gemini 无一幸免

一篇 116 页论文揭示前沿模型思维链重大安全漏洞,Anthropic、OpenAI、Google 的 API 因架构问题,模型隐藏推理过程可通过两次 API 调用被大规模提取,还会带来多种安全威胁。

AGI Hunt
算法论文8

迈向长程智能体,人大高瓴发布149页全景综述

新问题出现,长程智能体研究应运而生。人大高瓴发布149页综述,梳理超900项研究,从多视角给出长程智能体统一定义、分类与路线图,分析难点,提出核心论点与发展路径等。

机器之心