「长上下文大语言模型」共找到 8329 篇相关文章

开源动态8

DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?

凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。

PaperAgent
开源动态8

一个超级搜索Agent开源,超低成本拉满搜索推理能力!小参数、慢思考。

MiroThinker 1.5发布,打响2026年AI模型进步第一枪。它以小参数实现高性能,解决信息雾霾、AI幻觉、决策无力等问题,通过交互式扩展和时序敏感训练沙盒技术,展现强大搜索推理能力。

开源AI项目落地
新闻资讯8

马斯克xAI又融了200亿美元!老黄说到做到投了更多

刚开年,马斯克的xAI完成E轮融资,达200亿美元超预期。英伟达和思科等继续支持,其估值预计从500亿涨至2000多亿。还公布《xAI 2025年终总结》,Grok 5正在训练,传闻一季度推出。

量子位
推荐文章8

AI Coding 长文分享:如何真正把工具用起来,从原理到实践

本文系统分享高效使用AI编程工具的方法,涵盖底层机制、提升对话质量的方式、实际应用场景,还推荐结合AI的编码最佳实践,旨在助开发者用好AI工具。

阿里云开发者
开源动态8

清华系DeepSeek时刻来了,硅谷沸腾!单卡200倍加速,视频进入秒级时代

清华大学TSAIL实验室与生数科技开源视频生成加速框架TurboDiffusion,引发全球AI社区热议。它能在几乎不影响生成质量的前提下,让视频生成速度飙升100 - 200倍,将AI视频带入实时生成时代。

新智元
新闻资讯8

太魔幻了!刚刚OpenAI发布GPT Image 1.5:Nano Banana Pro 王座不保

OpenAI发布由GPT Image 1.5驱动的新版ChatGPT Images。新模型核心升级体现在精准修图、指令遵循能力强、生成速度提升4倍。还推出Images主页,API上线且价格降20%,适合企业。

AI寒武纪
产品应用7

我如何用低代码平台复刻NotebookLM体验:从文档到可控PPT生成,全流程实战。

本文作者用低代码平台BISHENG复刻NotebookLM的PPT生成功能。介绍了技术栈,详述工作流搭建,包括文档上传、问答、PPT生成等,还提及HITL机制提升成功率,最后总结了低代码平台的优势与不足。

AI大模型应用实践
新闻资讯7

GPT-5.2来了…

OpenAI推出GPT - 5.2系列,是适合专业知识工作的模型。它在专业工作表现、编程能力、可靠性与安全性等多方面有提升,定价公布,已向付费用户逐步推出,此次更新重在夯实基础。

AI工程化
推荐文章7

更多非共识,Test-time Scaling 能否一直大力出奇迹?

机器之心PRO会员通讯解读三个AI业内要事,包括Test - time Scaling非共识、Skills与MCP谁是大模型的HTTP时刻、OpenAI打造最强平台等问题,探讨流行路线局限、Scaling改进方向等。

机器之心
新闻资讯7

IJCAI 2026每篇投稿收100美元,学术圈却评价颇高

当下AI学术会议投稿评审体系受大模型冲击,投稿和低质量评审激增。IJCAI 2026将采取新投稿模式,每篇投稿收100美元,主论文豁免,费用支持审稿人,学者对此多持积极态度。

机器之心