专家级表现」共找到 3410 篇相关文章

算法论文8

全球首次,Transformer「混血」速度狂飙65倍!英伟达已下注

康奈尔、CMU等机构研究者提出「混合体」Eso - LM,融合自回归和离散扩散模型范式。它引入KV缓存机制,推理速度相比标准MDM提升65倍,在速度与质量平衡上超越BD3 - LM,引发AI领域关注,英伟达或押注此方向。

新智元
算法论文8

GraphRAG太慢LightRAG延迟高?华东师大新方法一招破解双重难题

华东师大李翔老师带领的Planing Lab团队推出E²GraphRAG方法,解决GraphRAG索引慢、LightRAG查询延迟高的问题。该方法用SpaCy识别实体,结合图和树查询,在构建和查询时间上表现出色。

量子位
算法论文8

CVPR 2025 | 多模态统一学习新范式来了,数据、模型、代码全部开源

中国人民大学、清华和腾讯合作的CVPR 2025论文指出,当前多模态学习范式有缺陷。为此提出新范式,构建AV - UIE数据集、Crab框架,实现任务互助,在多任务上超垂类专家模型,数据、模型、代码开源。

机器之心
算法论文8

开启 AI 自主进化时代,普林斯顿Alita颠覆传统通用智能体,GAIA榜单引来终章

普林斯顿大学AI Lab推出通用智能体Alita,秉持「极简即是极致复杂」哲学,采用「最小化预定义」与「最大化自我进化」设计范式,可自主创造MCP工具,在GAIA基准测试中表现卓越,还能实现MCP复用。

机器之心
产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
算法论文8

微软再放LLM量化大招!原生4bit量化,成本暴减,性能几乎0损失

微软公布BitNet v2,性能几乎0损失,占用内存和计算成本显著降低。它首次实现对1比特LLMs的原生4比特激活值量化,通过H - BitLinear模块处理异常通道,实验显示其在多方面表现优异。

新智元
推荐文章7

YC最新总结顶尖的提示词应该怎么写?

提示工程在大模型时代愈发重要,其核心在于提示词设计。近日,YC在播客分享从与大模型创业公司学到的提示工程实践,涵盖核心原则、进阶技巧、企业实践、创业者模式等内容。

AI工程化
产品应用7

DeepSeek-R1 更新,思考更深,推理更强

DeepSeek R1 模型完成小版本升至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。

AI工程化
推荐文章7

智能投顾的大模型应用,为什么选择了“大小模型协同”?

大模型时代,金融智能投顾落地是技术与业务安全的双重挑战。北银金科高算法专家尹辰轩表示采用“大小模型协同”架构,能在性能、准确性与合规间找平衡,还阐述了架构亮点、问题解决办法等。

InfoQ
产品应用7

V0 模型直接进驻 Cursor,UI 生成效果炸裂,氛围编码体验再升

AI 编码赛道竞争激烈,Vercel 的 V0 发布 AI 模型,可在 Cursor 中使用,还推出新工作流提升 UI 生成效果。文中介绍了 V0 特点、Cursor 设置方法及使用演示,还分析了 Vercel 自研模型的原因。

AI进修生