大模型效率」共找到 9790 篇相关文章

推荐文章7

模型的第一性原理:(二)信号处理篇

本文从信号处理角度解读模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。

机器之心
开源动态8

Agent 框架热潮褪去,模型开发已经进入“生死局”?

蚂蚁开源发布《2025 ⼤模型开源开发⽣态全景与趋势》报告,涵盖 19 个技术领域 135 个项目,解读七趋势。当下模型开发生态如黑客松,项目兴衰快速,AI Search 式微、AI Coding 火热,三技术领域也有变化。

AI前线
新闻资讯7

不再“纸上谈兵”:模型能力如何转化为实际业务价值

InfoQ《极客有约》X AICon 直播栏目邀华为云郑岩、蚂蚁集团杨浩、明略科技吴昊宇,探讨模型驱动业务提效。分享场景探索、技术落地经验,如选模型考量因素、AI Agent 创新等,还提及 MCP 应用与未来展望。

AI前线
算法论文7

模型也需要睡觉!让AI打个盹,醒来更聪明

卡内基梅隆学和马里兰学研究发现,模型处理长上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进长期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。

量子位
算法论文8

幻觉的根源找到了:模型说谎,是为了讨好你

清华学OpenBMB团队研究发现,模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
新闻资讯8

Ilya的首个模型来了!

掌握内幕的草莓哥爆料,Ilya正构建以TTT为核心的小型推理引擎。他预见传统模型的死穴,SSI将TTT概念落地,其引擎在数据效率等方面优势明显。SSI获投资,本月或发新模型

新智元
新闻资讯8

20万人抢的全球模型第一股,我中签了

智谱在港交所上市成全球模型第一股,作者申购中签。智谱专注AI Coding,迭代快,GLM - 4.7成绩亮眼,商业化数据佳,还有诸多有意思细节,虽行业竞争,但它表现不错。

花叔
新闻资讯7

AI Infra 工程师们如何应对模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨模型 Infra 工程师实战日常。涉及模型工程高频问题、版本迭代冲突处理、推理部署成本优化、开源项目挑战及 GPU 虚拟化趋势等内容。

AI前线
产品应用9

OpenAI押注RSI,国产AI火速交卷!Flash叫板万亿模型

OpenAI、Anthropic先后公开布局递归自我改进(RSI),国内云知声推出搭载RSI自迭代机制的U2-Flash模型,本文带来实测表现与技术路径拆解,验证小激活规模对标万亿模型的可行性。

新智元
推荐文章7

AI Infra 工程师们如何应对模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨模型 Infra 工程师实战日常。涉及模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ