通用推理技术」共找到 5052 篇相关文章

产品应用8

三星研究院发布手机端侧大模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧大模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
算法论文8

清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026

大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。

AI科技评论
新闻资讯7

在参与OpenAI、Google、Amazon的50个AI项目后,他们总结出了大多数AI产品失败的原因

Aishwarya Naresh Reganti 和 Kiriti Badam 参与超50个企业级AI产品构建。他们指出,如今AI产品构建成本降低,但多数仍失败。还分享开发陷阱与路径,如从低自治高控制起步、建立CC/CD框架等,也对AI未来发表看法。

InfoQ
推荐文章7

Self-Evolving 会是 2026 关键词吗?

2025年,Agent应用发展使LLM‘静态’局限成AI瓶颈,业界重视自进化能力,聚焦‘持续适应系统’。但该领域缺统一标准,有思潮认为统一标准、集体探索将带来机遇。还介绍了研究进展、重点演变等。

机器之心
推荐文章8

昇腾MindSpeed:分布式训练加速库的创新实践与突破

在2025年QCon全球软件开发大会上,华为工程师郑加利分享昇腾MindSpeed分布式训练加速库。它在计算、通信、显存等多维度优化,提升训练效率,还介绍业界加速库及MindSpeed架构,阐述多种优化策略。

InfoQ
新闻资讯7

本周六,2026崇礼论坛,俞敏洪、周鸿祎、姬十三、沙宝亮、储殷、吴世春都来!|甲子光年

2026年1月23 - 25日,2026崇礼论坛将在张家口崇礼区太舞小镇举行,主题为“向新而立”。开幕式有俞敏洪、周鸿祎等多位行业掌门人为AI定调,还有四大专场,各界大佬齐聚探讨AI多方面话题。

甲子光年
开源动态8

学术海报不用愁,一句话精准自动编辑,华东师大开源APEX

华东师范大学Planing Lab提出APEX框架,能通过自然语言指令实现学术海报局部可控编辑,引入「审查—调整」机制提升可靠性。还构建APEX - Bench评估,实验显示APEX优于其他方法。

新智元
开源动态8

沉浸式翻译杀疯了!双重开源:左手像素级还原PDF排版,右手本地AI隐私保护!

沉浸式翻译是跨平台在线翻译工具,有网页、文档等翻译功能,获千万用户与Chrome年度殊荣。近期开源BabelDoc和OneAIFW,前者还原PDF排版,后者保护本地隐私,解决阅读和安全问题。

开源星探
开源动态8

开源版Cowork爆火,逼得Anthropic下放Cowork

2026年1月,AI巨头Anthropic与开源项目Openwork展开定价权战争。开发者因嫌Claude Cowork贵,两天开发出Openwork。它免费、更快、更安全,迫使Anthropic将Cowork功能从$100档位下放至$20档位。

新智元
产品应用7

谷歌发布 Gemma Scope 2,深化对 LLM 行为的理解

Gemma Scope 2 是谷歌推出的解释 Gemini 3 模型行为的工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先的 Gemma Scope,还引入针对聊天机器人的分析工具,已发布权重。

InfoQ