「开源小模型」共找到 9377 篇相关文章
Anthropic试图彻底杀死Harness Engineering。
Anthropic推出新产品Managed Agents,定位是帮用户做Harness。它指出Harness保鲜期短,自己维护不划算。技术上把Claude Agent SDK拆成三块,让Harness成可热插拔模块。不过通用Harness有局限,开源社区也有新路线。
黄仁勋罕见长文:AI是一个五层蛋糕
黄仁勋认为AI是由能源、芯片、基础设施、模型、应用组成的五层蛋糕,是像电力、互联网一样的基础设施。目前AI建设刚起步,虽已产生经济价值,但大部分基础设施、劳动力、机会待实现。
Snowflake CEO 复盘:为什么 LLM 时代企业需要一个 AI Data Cloud?
Snowflake曾是企业数据平台代表,随AI崛起,CEO Sridhar推动其转型为AI Data Cloud。Snowflake Intelligence上线,不造基础模型,专注放大数据价值,其可靠、计费合理,核心竞争力在数据。
鹅厂门口免费装龙虾,几百人排爆了!一代人有一代人的鸡蛋要领
腾讯云工程师在鹅厂门口免费为几百人安装OpenClaw,提供“从装到玩”服务。OpenClaw是开源智能体框架,像“龙虾”,可自动操作电脑。目前GitHub Star数超27.04万,多家公司跟进。
像原始人一样和AI对话,费用可直接砍掉40%
开源项目‘caveman-compression’能帮使用ChatGPT API或其他大模型的用户省钱。原理是删废话留关键信息,有调用OpenAI和本地NLP两种压缩方式,不同场景省钱效果不同,还介绍了使用方法。
给你家 AI Agent 装个「长期记忆」,这个开源库一行代码搞定
Memori是开源的LLM记忆引擎/Python库,为聊天机器人等提供统一长期记忆层。它功能亮点多,如自动记忆分类、精准召回等,集成成本低,还有进阶玩法和企业安全能力。
Meta开源多语言语音识别系统,支持1600种语言,可轻松扩展新语种!
Meta研究团队开源Omnilingual ASR,能理解1600种语言,用几条语音 - 文本配对样本就能零样本扩展新语种。提供三种架构,满足不同需求,性能超现有多语种模型,应用场景广泛。
Jev 的「百亿补贴」迷局:既然「极省」为何还要狂送 1.2 亿 Token?
主打省Token的AI模型Jev,近日大手笔向用户发放1.2亿Token额度,本文深入分析这一反常操作背后的商业布局,拆解其抢占Agent小决策判断节点的底层逻辑。
项目在GitHub上已获得约3600+star,探秘 ChatDoctor:LLaMA 微调后的 AI 医生,真能在线问诊?
现代医疗资源不均、问诊效率低,ChatDoctor应运而生。它基于LLaMA微调,有医学对话微调等亮点,技术优势多,适用于在线问诊等场景,与同类对比优势明显,开源助力医疗对话模型发展。
国产双开源:让Mac成为你的私人AI工作站
2026年3月底,Ollama将Mac版底层推理引擎换为苹果MLX框架,性能提升显著。明略科技开源Cider和Mano - P,Cider加速推理,Mano - P可操作图形界面,两者结合推动Private AI发展。