「上下文图」共找到 913 篇相关文章
12月,我们推荐这 7 款 AI 新品
极客公园创新大会为7款AI新品策划线下发布会。包括笔记产品flomo、AI相机Doka等,各产品创始人分享理念,如flomo不做AI润色,Doka让AI仅作拍照辅助等。
以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA
Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。
每次画架构图都快崩溃?这个开源 AI 版 draw.io 一句话帮你搞定
Next AI Draw.io是基于Next.js + draw.io的开源Web应用,给draw.io加了AI大脑。它能让用户用自然语言画图、改图、补图,解决画架构图等耗时费力问题,有诸多功能亮点,适合特定人群。
下一代架构设计工具,说话就能画
next-ai-draw-io是开源项目,用自然语言描述就能让AI自动生成draw.io格式的图。有文字生成图表等核心功能,技术栈用Next.js + AI SDK + react-drawio,支持多提供商,还介绍了安装、部署方法。
DeepSeekV3.2技术报告还是老外看得细
ChatGPT三岁生日时,DeepSeek两款开源模型DeepSeek-V3.2和DeepSeek-V3.2-Speciale引发热议。它们在智能体评测中表现出色,缩小了开源与闭源模型差距,还降低了成本,给硅谷闭源AI公司带来压力。
AI工具已成为史上最大流量入口?
作者白杨SEO看到一张称主流AI工具成史上最大流量入口的图,提出质疑。他指出数据存疑,AI用户使用量远不及搜索,商业化也不成熟,还对比国内外AI搜索优化GEO差异,认为企业要提前布局。
Kimi开源新线性注意力架构,首次超越全注意力模型,推理速度暴涨6倍
月之暗面发布开源Kimi Linear架构,用新注意力机制首次超越全注意力模型。长上下文任务中,它减少75%的KV缓存需求,推理加速达6倍。核心创新Kimi Delta Attention有细粒度遗忘门控等特点。
北航团队提出新的离线分层扩散框架:基于结构信息原理,实现稳定离线策略学习|NeurIPS 2025
北航彭浩团队提出SIHD框架,基于结构信息原理,自适应构建多尺度扩散层级,实现稳定离线策略学习。通过构建状态拓扑图、用结构信息增益引导扩散、引入结构熵正则化器,在D4RL测试中表现出色。
节前重磅:开源旗舰模型新SOTA,智谱GLM-4.6问世
国庆前智谱AI发布新一代旗舰模型GLM-4.6并将开源,它在多方面提升,如编码、上下文长度等,评测性能佳,token消耗降低。经实测,其代码、研究、开发等能力强,成全球开源AI领域重要力量。
LLM加速利器LMCache,极大降低GPU资源消耗
LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。