测试时路由框架」共找到 3186 篇相关文章

推荐文章8

大语言模型的解耦:人工智能基础设施的下一轮进化

人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍大语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。

InfoQ
开源动态8

狂涨20.8K star!GitHub 官方出品,强烈推荐!

介绍开源项目 `GitHub Desktop`,它基于Electron开发,用TypeScript编写并使用React框架,支持Windows和Mac,集成常用Git操作,有直观图形界面等特色,助开发者轻松使用Git,目前获20.8K star。

开源先锋
新闻资讯7

AI取代放射科医生还早!Karpathy最新发声:软件工程师也不会失业

Andrej Karpathy发文推荐‘AI并未取代放射科医生’文章,并分享对AI与就业市场关系看法。他指出外界对AI影响就业有‘天真预测’,还阐述用AI取代放射科医生不易的原因及工作因AI变化的标准。

AI寒武纪
产品应用8

百度Qianfan-VL,发票/图表/合同等PDF识别94.75%刷新纪录!

当前主流视觉 - 语言模型在企业级应用有难点,百度千帆团队提出Qianfan - VL系列多模态大模型,在通用和企业级任务表现出色,基于自研芯片训练,还提供框架与管线降低成本。

CourseAI
开源动态7

The Batch: 882 | Qwen3-Next 提速

阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。

DeeplearningAI
产品应用7

蚂蚁集团发布KAG-Thinker,多跳问答慢思考,医疗领域拿下87分

在LLM问答领域,多跳问题存在局限性,现有方法缺乏严谨性等。KAG - Thinker是基于KAG框架的模型,将复杂问题分解,通过多模块优化知识获取,在医疗领域实用,稳定性也出色。

PaperAgent
算法论文8

SIGCOMM 2025|重新定义个性化视频体验,快手与清华联合提出灵犀系统

快手与清华孙立峰团队联合发表论文,提出灵犀系统,这是业界首个大规模生产环境中面向用户个性化体验的自适应视频流优化系统。该系统能解决现有方法在部署中的难题,实现个性化QoE优化。

机器之心
算法论文8

自搜索强化学习SSRL:Agentic RL的Sim2Real时刻

本文由多机构联合完成,引入自搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。

机器之心
算法论文8

40年首次突破!清华大学发布全新最短路径算法,打破理论瓶颈:数据中心有望节省大量计算资源

清华大学Ran Duan、Longhui Yin团队发表论文,提出确定性新算法,在稀疏图上表现超经典Dijkstra算法。新算法时间复杂度为`O(m log²/³ n)`,不维护全局有序顶点队列,应用前景广,可节省计算资源。

AI寒武纪
开源动态8

史上最大高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”

上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位