「小模型推理能力」共找到 9427 篇相关文章

产品应用8

引爆千亿市场!杭州AI再出王炸:刷新自研天花板,“三甲专家大脑”装进14亿人口袋

在2026智诊科技AI发布会上,智诊科技完成蜕变。其发布的Wise MemOS 2.0打破传统局限,WiseDiag V2有深度多模态联合分析能力,WiseResearch让AI告别幻觉,“好伴AI”下放技术,服务大众。

AI寒武纪
产品应用7

阿里千问你别太荒谬!连漫画PPT都能一键生成?我以前那些夜真是白熬了

阿里千问发布AI PPT生成工具Qwen AI Slides,从内容结构到视觉配图全包。实测显示,其语义理解能力不错,文本渲染在简单字体表现好,排版有小瑕疵,适合课堂展示等场景。

量子位
新闻资讯7

The Batch: 906 | AI 巨头分担维基百科的成本

维基百科成立25周年,维基媒体基金会与Amazon、Meta等多家AI公司达成合作,推出Wikimedia Enterprise计划,允许合作方高速大规模访问数据。维基百科需资金支持,AI公司也需其数据训练模型。

DeeplearningAI
算法论文8

清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
算法论文7

告别RAG相似匹配!百度Agentic-R为多轮搜索重塑检索器

传统检索增强生成(RAG)有“单跳”局限,多跳推理易出错。人大高瓴与百度提出面向智能搜索的检索器训练框架 Agentic - R,采用双视角打分和双向飞轮模式,在多数据集上表现出色。

PaperAgent
新闻资讯8

Mistral 发布 OCR 3,提升了手写及结构化文档识别的准确率

Mistral 发布 OCR 3,在多种文档类型上精度更高,超越前一代产品。能提取文本、识别图像并保留文档结构,输出 Markdown 格式。早期用户认可其性能和多语言支持,生产部署扩展快,价格有优势。

InfoQ
开源动态7

AI用3年时光,来了解你!首个AI Clone长期记忆基准

现有AI记忆评测存在数据源单一、忽视变化本质、注入成本高等局限。开源学术社区QuantaAlpha联合高校团队提出CloneMem基准测试,构建合成人生,设计评测任务,实验发现简单方法在检索上更有效,记忆系统应还原信息。

新智元
产品应用8

摩尔线程AIBOOK一周实测:开箱即训的「AI Native」体验

摩尔线程AI算力本MTT AIBOOK专为AI学习与开发者打造。它搭载「长江」芯片,提供50TOPS异构AI算力,运行MT AIOS系统,预置完整AI开发环境。实测显示其部署简单,性能出色,还具备端云一体等优势。

新智元
开源动态8

你的论文有novelty吗?复旦搞了个顶会论文查新系统

复旦大学NLP团队与WisPaper合作研发OpenNovelty系统,用于论文新颖性评估。系统基于大语言模型,强调证据与可验证性,有四步分析流程,已分析1360篇投稿并公开报告,有辅助作用但有局限。

机器之心
推荐文章7

关于 AI Agent,你最想知道的 3 个问题——为什么我说“垂直 Agent”是个伪命题

文章解答了关于 AI Agent 的三个读者问题,包括概念定义、大厂推出的原因及商业化前景、通用与垂直类 Agent 的商业前景。指出 Agent 是 AI 落地有价值方向,目前有挑战,真正机会在围绕其构建的数据、工具和行业理解。

宝玉AI