「1.5B 模型」共找到 9269 篇相关文章
Agent下半场!比Prompt更重要的是「上下文工程」,Anthropic首次系统阐述
Anthropic发文章阐述上下文工程,指出构建语言模型重点正从提示工程转向上下文工程,探讨了其与提示工程区别、重要性,给出实践指导原则、新趋势及应对长时程任务策略。
DeepSeek突然拥抱国产GPU语言!TileLang对标CUDA替代Triton,华为昇腾Day0官宣支持适配
DeepSeek v3.2开源TileLang版本算子引关注,其可对标CUDA替代Triton,还适配国产算力生态,华为昇腾官宣支持。TileLang由北大团队主导,提供不同层次编程接口,助DeepSeek提升性能。
vLLM PIECEWISE CUDA Graph 技术学习笔记
文章围绕vLLM PIECEWISE CUDA Graph技术展开,介绍了vLLM Compilation架构、分片编译技术、算子融合、集合通信融合、编译缓存、装饰器系统等内容,PIECEWISE技术让vLLM在prefill阶段性能提升。
刚刚,Meta挖走OpenAI清华校友宋飏,任超级智能实验室研究负责人
本周四消息,原OpenAI战略探索团队负责人宋飏加入Meta,任新成立的Meta超级智能实验室研究负责人。今年6月起Meta开启AI人才争夺,已挖来至少11位顶尖人员,宋飏加入为其AI部门添活力。
「一页纸」吃透产业链之:人形机器人,Figure链与特斯拉Optimus链
文章聚焦人形机器人,分析其产业处于量产落地拐点,2025 - 2026年是关键期。介绍产业链上中下游情况,指出面临的软硬件挑战,还提及市场规模、主要参与者,重点关注Figure与特斯拉Optimus产业链。
API协议全景图:从REST到MCP的选型指南
本文以开源项目 HiMarket 为背景,梳理从传统 Web 到现代 AI 场景下六种主流 API 协议,如 RESTful、GraphQL 等,介绍其核心定位、技术特点与适用场景,助开发者厘清相关概念。
谷歌AI新里程碑:一个能「做研究」的系统诞生了,用LLM+树搜索编写专家级软件
谷歌提出能帮科研人员编写「专家级」科研软件的AI系统,融合大语言模型和树搜索,可整合重组知识构建新思路。在多领域超人类表现,但局限于可量化任务。
三个月、零基础手搓一块TPU,能推理能训练,还是开源的
加拿大西安大略大学工程师暑期打造开源 ML 推理、训练芯片 TinyTPU。他们非专业出身,从基础学起。还介绍了造 TPU 原因、硬件知识、构建方法,及推理、训练的实现。
11.8k Star 爆火!Firecrawl开源王炸,秒级生成React应用!
知名网页抓取工具Firecrawl团队推出开源项目Open Lovable,几天内获11.8k Star。它是AI网页克隆工具,能秒级将网站克隆为React应用,功能丰富,适合多类人群,还介绍了上手步骤和应用场景。
Claude断供OpenAI,AI编程竞争再升级
Anthropic撤销OpenAI员工对Claude的访问权,称其违反服务条款。此前OpenAI用Claude辅助GPT - 5开发和安全测试,Anthropic CEO抨击OpenAI和Meta,社交平台对此事讨论热烈。