「上下文成本」共找到 2088 篇相关文章
一年后,DeepSeek-R1的每token成本降到了原来的1/32
几天前,DeepSeek更新R1论文至86页,公开训练全路径等细节。英伟达发表博客展示在Blackwell GPU上对其降本增效,通过软硬协同提升每瓦特Token吞吐量,还介绍了TensorRT - LLM软件及相关技术提升性能的情况。
隐藏超多上下文工程(Context Engineering)技巧的框架,来试一试吧!
文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。
Agent取代App、机器人“盲区”、RAG成本失控……2026 奇点智能技术大会首批议题发布
4月17 - 18日,CSDN与奇点智能研究院联合主办的「2026奇点智能技术大会」将在上海举行。大会首次剧透部分核心议题,覆盖AI全生命周期各层面,多位技术专家将分享实战经验与前沿探索。
工业级文本转SQL新思路:成本暴降、超3000列超大数据库依然稳健
华中科大与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超大规模数据库模式的高精准链接与筛选,以低Token消耗刷新两大榜单纪录。
全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑大模型
中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲大模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。
刚刚,好莱坞特效师展示AI生成的中文科幻大片,成本只有330元
AI领域发展迅速,视频生成能力提升。百度全球首发中文音视频一体化模型百度蒸汽机2.0,实现人物口型等毫秒级同步,多版本升级且价格有竞争力。实测效果好,技术上解决难题,还开创应用驱动研发范式。
AI4Science 图谱,如何颠覆10年 x 20亿美金成本的药物研发模式
文章指出AI for Science让生命科学与数字互联网融合,加速科学发现。以四象限为框架,梳理了Biology Foundation Model、AI Scientist等玩家,介绍相关模型和公司,展示其对药物研发流程的重塑。
一篇论文改写AI科研评价规则!中国公司拿出实践数据,双榜第一、成本更低
今年科技巨头入局AI4S,想打造“AI科学家”。8月19日《Measuring AI Scientists: From Exams to Discovery》论文提出评价范式。深度原理MIRA平台是现实样本,在评测中表现优异,沉淀闭环数据。
终于找到一个开源神器!用画布喂给 Claude Code,上下文再也不用打字说了!
开发者用文字向 AI 说明需求繁琐,思路易跑偏。BonsAI 是 macOS 原生应用,提供无限画布,可让 Agent 实时读取改写。它亮点多,还有连接器功能,能成编程工具‘前置处理器’。
8 个月做到 1 亿美元 ARR,Lovable 增长负责人:免费用户不是成本,是营销渠道
Lovable增长负责人Elena Verna分享产品增长经验,指出增长团队核心是解决分发问题,PLG概念被过度炒作,传统增长策略失效,应把免费产品当营销预算,还给出未来增长的8个关键策略。