嵌入式分析引擎」共找到 1421 篇相关文章

产品应用7

LLM加速利器LMCache,极大降低GPU资源消耗

LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。

GitHubStore
算法论文8

微调重要表征以增强思维链的推理能力

团队提出关键表征微调(CRFT)方法,通过信息流分析识别和优化关键表征。在八个数学和常识推理基准及两个模型系列验证其有效性,能提高推理准确率,学习参数量低,还适应少样本场景。

深度学习自然语言处理
推荐文章7

上下文就是一切!行业热议话题:提示工程是否应该改名

AI圈热议提示工程是否应改名“上下文工程”。Shopify CEO等发表看法,指出其在LLM应用和AI Agent构建中很重要,还分析了重要性、优化方法,给出实践经验,强调要在性能、成本和准确性间平衡。

歸藏的AI工具箱
新闻资讯7

直播预约 | 推理模型的“过思考”现象与高效推理,2.5h的深度分享

本期GenTalk学术分享邀请刘梓辰、齐朋辉等4位博士生,在2025年6月6日15:00 - 17:30带来“推理模型的‘过思考’现象与高效推理”报告,由夏鹤明主持,NICE学术等支持。将分析‘过思考’因素,总结高效推理思路。

深度学习自然语言处理
新闻资讯8

AI「看见」实验,哈佛颠覆性突破!一副AR眼镜,新手秒变资深专家

哈佛大学刘嘉教授团队研发人机共融智能系统,含APEX和Agentic Lab。前者用于微纳加工,后者用于生命实验。实测显示,它们能实时纠错、自动记录分析、实现技能迁移,让AI与人类在科研制造中深度融合。

新智元
开源动态8

中国科大Science-Star(科星) : 一体化、可扩展的科学智能体搭建平台

中科大认知智能全国重点实验室开发了 Science - Star 科研智能体平台。它基于 ReAct 引擎,有一体化可视化支持、插拔式模块化架构和跨学科工具集成等特色,为科研智能体研发与实验提供高效基础设施。

PaperAgent
新闻资讯8

从高考到实战,豆包大模型交卷了

火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。

机器之心
新闻资讯8

以为Anthropic全是科学家?数据告诉你,他们要的是基础设施老兵

Fonzi AI人才工程主管Seb分析1680份Anthropic工程师简历,发现其核心人才是资深基础设施建设者。工程团队18个月从零膨胀,Google是最大人才池,博士仅占13.7%,头衔扁平化。

AIGC开放社区
开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【上篇】

文章实测开源的AI数据统一访问引擎MindsDB,介绍其架构、安装启动方法,展示跨多数据源统一查询、AI模型赋能数据查询等功能,还将在下篇介绍知识库与智能体特性。

AI大模型应用实践
算法论文8

模型是谁的?LLM版权保护首个技术综述论文发布

浙江大学和君同未来团队发布《Copyright Protection for Large Language Models: A Survey of Methods, Challenges, and Trends》。论文以“模型指纹”为核心理念,打通三个技术流派,指出文本水印难护模型版权,还分析各类指纹技术优劣势并给出未来方向。

深度学习自然语言处理