混合搜索」共找到 622 篇相关文章

开源动态8

租了8张H100,他成功复现了DeepSeek的mHC,结果比官方报告更炸裂

元旦期间,DeepSeek发布的mHC震撼AI社区。FlowMode工程师Taylor Kolasinski租8张H100复现mHC,结果比官方报告更优。文章介绍复现实验,对比mHC、HC和标准残差结构,揭示超连接在规模化时的不稳定性及mHC的解决办法。

机器之心
新闻资讯7

悲报!Stack Overflow彻底凉了,比18年前上线首月问题数量还少

曾经的程序员问答圣地Stack Overflow凉透了,如今提问数量比18年前上线首月还少。它曾是Google技术搜索默认落点,巅峰时有180多个子站。AI兴起改变开发者习惯,加上自身问题,使其走向衰落。

量子位
新闻资讯7

从“卡脖子”到“破局点”:一家中国公司的高端半导体键合突围战

芯师爷专访迈姆思半导体负责人潘总,该公司专注高端半导体材料“再制造”,技术体系有高端SOI制造、异质集成、混合键合三大支柱。其在多领域有领先产品,技术壁垒高,产能将逐步扩大,供应链安全可控。

芯师爷
开源动态8

长上下文快2.9倍,解码快6倍:Kimi 用线性注意力实现性能与效率双突破

月之暗面团队的Kimi Linear模型,是混合线性注意力架构,核心是Kimi Delta Attention模块。它解决线性注意力的记忆及遗忘问题,在多任务测试表现出色,还开源相关资源,推动高效长上下文模型研究。

AIGC开放社区
新闻资讯7

苹果秋季新品发布会,全系全面拥抱AI,比Pro还要Pro的iPhone Air已加购物车。

苹果秋季发布会如期而至,带来AirPods Pro 3、Apple Watch系列、iPhone系列新品。新品在AI功能融合上有进步,如AirPods的实时翻译与心率监测、Apple Watch的健康预警、iPhone的图片搜索与AI翻译等。

开源AI项目落地
推荐文章8

为什么Claude Code 如此好?「以及如何在自己工作流中复刻Claude Code体验」

本文分析Claude Code好用的原因及如何复刻其体验。作者抓包分析其请求后给出要点,如可调试性优先、保持单一循环、LLM搜索优于RAG等,还阐述控制循环、提示词、工具等设计方法。

AI寒武纪
新闻资讯8

奥特曼神秘晚宴讲话曝出!OpenAI的CEO或将是个AI,Chrome我也想买

OpenAI的奥特曼在晚宴勾勒宏大愿景,要颠覆搜索、社交等领域,斥资数万亿打造数据中心和新硬件,还探索脑机接口。他认为AI潜力大但处于泡沫期,也谈到GPT-5、算力融资等问题。

新智元
推荐文章7

在 AI 时代构建 MVP

文章围绕AI在构建最小可行产品(MVP)中的作用展开。它能在理解QARs、推动架构决策等多方面提供帮助,如提出被忽略的需求、缩小技术搜索范围等,但不能完全替代人类做决策。

InfoQ
推荐文章7

8种LLM架构设计大比拼:从 DeepSeek-V3 到 Kimi K2,究竟有啥不同

文章对比了8种LLM架构设计,如DeepSeek-V3、OLMo 2等。介绍各模型关键技术,像DeepSeek-V3的多头潜在注意力和混合专家架构,还分析不同设计对性能、效率的影响,助读者了解LLM架构差异。

CourseAI
开源动态8

DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持

Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。

AI工程化