「混合专家层」共找到 977 篇相关文章
清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源
5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。
两个哈佛女生用AI做电池故障排查,数月的工作量被缩到了几分钟
哈佛毕业女生 Eva Tuecke 和 Catherine Yeo 创立 Altara 公司,获 700 万美元种子轮融资。其系统能整合电池等物理科学领域分散数据,将故障排查时间从数月缩至几分钟,还能确保输出可审查,适应不同机构需求。
突发,OpenAI总裁当庭「认罪」!自曝零元购300亿,马斯克这回真要赢了?
2026年5月奥克兰联邦法院,马斯克与OpenAI对簿公堂。OpenAI总裁Brockman当庭承认零投入获300亿美元股权,还涉及Cerebras自我交易。专家担忧AGI竞赛风险,双方各执一词,审判反映硅谷价值观冲突。
编程智能体的核心组件【译】(重发,补图)
文章围绕编程智能体展开,先厘清大语言模型、推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能体六大核心组件,还对比了与 OpenClaw 的区别。
让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间
谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。
刚刚,Anthropic分享了构建Skills的最佳实践
Anthropic获300亿美元融资,估值达3800亿美元,发布《The Complete Guide to Building Skills for Claude》指南。介绍Claude Skills本质、与MCP关系、应用场景、技术实现、设计模式及测试迭代方法。
《多模态大语言模型技术发展报告》正式发布 | 中科算网算泥社区
2月5日,中科算网算泥社区发布《多模态大语言模型技术发展报告》。报告回顾多模态大模型发展历程,剖析核心技术创新,展示应用实践,分析挑战与机遇,为各界提供参考,推动多模态AI技术发展。
倒反天罡:「租个人」网站爆火,AI开始雇人「跑腿」了
「rentahuman.ai」网站定位为「AI 的肉身层」,AI 可通过 MCP 协议或 REST API 雇人完成线下任务。网站上线后人力增长快,但也引发付款、任务真实性、安全伦理等疑问。
未来两年软件工程展望:从写代码到管 AI,程序员正分化成两种职业
软件行业处在转折点,AI 推动编程变革,企业更重效率。文章围绕五个关键问题展望 2026 年软件工程,分析初级开发者、技能、角色、专家与通才、教育等问题的不同情景,还给出应对建议。
今天,分享Clawdbot记忆系统最佳工程实践
文章分享了 Clawdbot 记忆系统的最佳工程实践。它能自主处理现实任务,其持久记忆系统独特,将一切保留在本地。文中介绍了上下文构建、记忆存储、搜索等方面,还提及多代理记忆、压缩、刷新等内容。