「混合推理方案」共找到 2943 篇相关文章
《苏州市智能算力产业创新中心建设计划》正式发布
2月28日,《苏州市智能算力产业创新中心建设计划》发布。由移动云牵头,依托其资源联合各方打造开放式AI算力创新平台。立足苏州产业优势,确立‘1+3’架构,以OAS为核心,分三年推动产业化落地。
清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026
大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。
六联智能聚力AI谱新篇!
2026年2月1日,六联智能18周年感恩盛典在深圳启幕,展示其从IDH代工转型全栈式AI服务商历程。企业锚定目标,与英特尔协同打造全栈解决方案,还明确战略,各方达成AI产业发展共识。
Linus 之后的 Linux?内核社区终于写下“接班预案”
Linux内核社区准备了一套交接方案,以防Linus Torvalds发生意外或退休。该计划未指定唯一继承人,明确了选择流程。有人提议拆分顶层维护职责给多人,目前Torvalds暂无退休打算。
谷歌发布 Gemma Scope 2,深化对 LLM 行为的理解
Gemma Scope 2 是谷歌推出的解释 Gemini 3 模型行为的工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先的 Gemma Scope,还引入针对聊天机器人的分析工具,已发布权重。
特斯拉们,慌了?英伟达智能驾驶实测曝光:仅用一年追平马斯克八年心血
英伟达汽车业务虽仅占总收入1%,但十年积累已成气候。其与Uber合作、推广L2级城市功能,到2028年将实现L3高速公路驾驶,仅用1年几乎追上马斯克的FSD。实测中英伟达自动驾驶表现出色,新系统也有诸多亮点。
告别“一眼定生死”:Agent-as-a-Judge 开启 AI 评估的下半场
过去两年,LLM-as-a-Judge成评估界“黄金标准”,但面对复杂任务力不从心。论文《A Survey on Agent-as-a-Judge》指出,应从单一的大模型裁判进化为具备行动能力的智能体裁判,还阐述了其优势、发展阶段等。
一年后,DeepSeek-R1的每token成本降到了原来的1/32
几天前,DeepSeek更新R1论文至86页,公开训练全路径等细节。英伟达发表博客展示在Blackwell GPU上对其降本增效,通过软硬协同提升每瓦特Token吞吐量,还介绍了TensorRT - LLM软件及相关技术提升性能的情况。
开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型
由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。
OpenAI内部代码泄露!最强模型「皇帝」登基,0思考延时吓人
OpenAI代码泄露,神秘的「企鹅家族」模型在测试,代号Emperor的推理预算最高。同时,ChatGPT将推「记忆搜索」功能。此前谷歌Gemini 3抢份额,OpenAI或提速发布GPT - 5.2抗压。