小模型性能」共找到 8766 篇相关文章

开源动态8

Andrej Karpathy 盛赞!斯坦福团队新作,让Llama-1B 实现毫秒级推理

斯坦福Hazy Research团队将开源模型Llama - 3.2 - 1B前向推理整合为“Megakernel”,把推理延迟大幅降低,显存带宽利用率显著提升。团队指出当前主流LLM推理系统在batch、极低延迟场景下低效,提出Megakernel以重构执行方式。

AI科技评论
开源动态8

最鲁棒的MLLM!港科大开源「退化感知推理新范式」 | AAAI'26

多模态大语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科大等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元
新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所
新闻资讯7

GPT-5 放弃追求智能上限了?

GPT-5发布,虽借OpenAI名气获流量,但AI科技评论认为其结果令人失望。它推销转向任务性能提升,非基础大模型能力突破。虽成果出色,但也引发对AGI发展的反思,还面临诸多难题。

AI科技评论
新闻资讯8

斯坦福423页AI报告出炉!中美差距仅2.7%,清华DeepSeek冲进全球前十

斯坦福发布「2026年AI指数报告」,长达423页,揭示全球AI产业版图。指出中美AI模型性能差距仅2.7%,AI发展迅速但人类管控能力未跟上,还呈现出就业、算力、应用等多方面趋势。

新智元
算法论文7

八年后,Meta教会了Transformer「显式思考」

10月20日Meta上线新论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer新架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。

机器之心
算法论文8

提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础

大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。

深度学习自然语言处理
算法论文8

0.01%参数就能接近全量微调!低数据微调极致省参方案来了 | ACL'26

瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。

量子位
新闻资讯7

Claude不让我们用!国产平替能顶上吗?

全球AI代码生成竞争格局生变,Anthropic地位动摇,一是OpenAI GPT - 5崛起,二是自身迷之操作。此时国产大模型发力,如Kimi - K2 - 0905、Qwen3 - Max - Preview,性能和价格有优势,有望改变竞争格局。

机器之心
新闻资讯7

苹果的局面,很迷惑

作者对比 Google I/O 大会上谷歌的表现,认为苹果在 WWDC 上的表现令人失望。苹果更新设计语言,其 AI 侧重端侧模型,有数据安全等优势,虽目前参数量,但端侧 AI 或成新战场。

MacTalk