个人上下文」共找到 924 篇相关文章

开源动态8

DeepSeekV3.2技术报告还是老外看得细

ChatGPT三岁生日时,DeepSeek两款开源模型DeepSeek-V3.2和DeepSeek-V3.2-Speciale引发热议。它们在智能体评测中表现出色,缩小了开源与闭源模型差距,还降低了成本,给硅谷闭源AI公司带来压力。

量子位
推荐文章7

AI 正在奖励那些「最不专业」的人

文章以AI能力为上涨的潮水、个人专业技能为柱子作比,指出AI先替代简单重复工作,再逐级挑战复杂工作。高精尖专家因专业技能高难,难见AI价值;创业者则受益于AI对琐碎事务的处理。

特工宇宙
开源动态8

Kimi开源新线性注意力架构,首次超越全注意力模型,推理速度暴涨6倍

月之暗面发布开源Kimi Linear架构,用新注意力机制首次超越全注意力模型。长上下文任务中,它减少75%的KV缓存需求,推理加速达6倍。核心创新Kimi Delta Attention有细粒度遗忘门控等特点。

量子位
开源动态8

节前重磅:开源旗舰模型新SOTA,智谱GLM-4.6问世

国庆前智谱AI发布新一代旗舰模型GLM-4.6并将开源,它在多方面提升,如编码、上下文长度等,评测性能佳,token消耗降低。经实测,其代码、研究、开发等能力强,成全球开源AI领域重要力量。

机器之心
产品应用7

Ollama 推出免费搜索API + MCP集成:Cline、Codex一键接入网络搜索( + Qwen 搭建迷你搜索代理 )

Ollama推出免费Web搜索API,个人使用免费,本地和云端模型均可调用,还出了MCP服务器。它能让开源模型执行长期研究任务,还介绍了用其与Qwen搭建迷你搜索代理及MCP集成的方法。

AI进修生
新闻资讯7

GPT-5最大市场在印度?Altman最新访谈:可以聊婚姻家庭,但回答不了GPT-5为何不及预期

2025年8月8日OpenAI发布GPT - 5引热议。个人消费者多有不满,反馈体验差、性能不强;企业级市场却很欢迎,多家公司已采用。Sam Altman在访谈谈其特性,还聊了职业、家庭、AI发展等话题。

InfoQ
产品应用7

LLM加速利器LMCache,极大降低GPU资源消耗

LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。

GitHubStore
新闻资讯7

OpenAI 开源模型泄露:六大技术细节

OpenAI 可能发布的开源大模型细节泄露,包含两款模型,1200 亿参数 MoE 模型和 200 亿参数稠密模型,专注文本处理。还涉及训练技术、激活函数、上下文窗口、注意力机制及底层架构等方面的技术细节。

AI寒武纪
产品应用7

GLM4.5实测:审美不如R1,全栈还不大可用,别急冲

7月29日智谱开源GLM - 4.5。作者实测发现其在UI设计审美不如R1,生成卡片表现不一,Coding能力勉强及格,全栈代码生成未达可用阈值,存在无多模态能力、上下文窗口短等问题,目前还别急着冲。

AI产品黄叔
推荐文章8

程序员的提示工程实战手册

文章围绕程序员如何利用提示工程让AI编程助手成为可靠开发伙伴展开。介绍给AI代码助手的提示词技巧、高效代码提示原则,还阐述调试、重构、实现新功能的提示模式,指出常见反模式及应对方法。

宝玉AI