「前缀和计算」共找到 7335 篇相关文章

算法论文8

逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%

Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。

AIGC开放社区
开源动态8

先解行为,再训Agent:CMU开源首份Agentic Search日志数据,把Agent拆开给你看

CMU团队基于DeepResearchGym平台,从半年真实流量中整理出数据,构建并在Hugging Face开源首个Agentic Search行为日志数据集。还提出三层分析框架,刻画智能体搜索行为,为研究和系统设计提供基础与信号。

机器之心
算法论文8

Relink:为GraphRAG动态构建证据图

大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。

PaperAgent
推荐文章7

我扒开Clawdbot的底层架构,简单到离谱,你看完就能自己写。

近期Clawdbot让科技圈震惊,作者花一下午分析其架构和源码后发现,它简单到看完文章就能自己写。它是电脑进程,消息处理分六步,记忆靠写文件,操作电脑有三类工具,无黑科技。

探索AGI
产品应用7

搜狗输入法,居然还在更新??

在腾讯微信输入法上线、各类AI新产品轰炸的当下,搜狗输入法进行20.0 AI大版本升级。它有AI文本翻译、轻声识别等功能,用AI大模型全面重构,还接入腾讯混元、DeepSeek R1大模型,免费提供AI服务。

量子位
推荐文章8

大模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
研究论文7

Nature科学报告:对AI的焦虑,理科偏接受学习,文科偏批判回避

青海大学等团队在《Nature》科学报告发文,调查三所川校师生对AI的焦虑与采用意愿。研究构建新框架,整合三种AI焦虑,发现不同焦虑对技术接受影响不同,学科和自我效能也会调节转化路径。

AIGC开放社区
开源动态8

阿里开源 Qwen3-TTS 全家桶!语音设计、克隆、生成全打包,开源 2 天 3K Star!

阿里通义团队开源 Qwen3 - TTS 全家桶,含语音设计、克隆、生成功能,开源 2 天获 3K + Star。它有秒级克隆、语音设计等能力,有 0.6B 和 1.7B 两种规格,双轨架构等技术创新保障性能。

开源星探
新闻资讯7

苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!

苹果和谷歌达成多年合作协议,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及云技术构建,为 Siri 等功能提供核心支持。此合作引发行业讨论,马斯克质疑权力集中,也影响了 OpenAI 在苹果生态的角色。

AI前线
开源动态8

DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?

凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。

PaperAgent