前缀和计算」共找到 7288 篇相关文章

算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE GNE,验证其在提升效率同时保留模型能力。

机器之心
推荐文章8

DeepSeek V3到V3.2的进化之路,一文看全

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域知识。

机器之心
算法论文8

Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16

Sea AI Lab 新加坡国立大学研究指出,强化学习微调中训练不稳定性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。

AI寒武纪
算法论文7

OpenAI谈:大模型为什么会有幻觉?如何避免?

OpenAI论文探讨大模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练后训练阶段剖析根源,提议改造评测,引入置信度阈值错误惩罚机制。

探索AGI
新闻资讯7

「小米们」的百镜大战,带火国产眼镜老板

今年10月以来,AI、AR眼镜迎新品发布期,双11销售大增,带火眼镜制造商零售商。传统眼镜厂商受益于配镜需求高利润率,但也面临价值量少、选择多等问题,且难成持续增长主力曲线。

芯师爷
算法论文8

用“因果规划”解决多智能体协作中的任务依赖难题|港科广&腾讯

港科广腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界多智能体系统。该方法含全局因果任务图,框架分“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。

量子位
开源动态8

SGLang支持GPT-OSS:从Day 0支持到性能增强

SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。

GiantPandaLLM
新闻资讯8

马斯克「世界模拟器」首曝,1天蒸馏人类500年驾驶经验!擎天柱同脑进化

特斯拉官宣「世界模拟器」,可模拟、合成自动驾驶的「孪生世界」,生成不同视角长尾场景。它基于端到端神经网络,有学习人类价值观等优势。还能用海量数据解决难题,输出可解释中间结果,为自动驾驶擎天柱训练服务。

新智元
开源动态7

Mem0,用LLM给智能体解决记忆问题,开源

大模型训练后知识记忆不再增加,智能体记忆能力发展不理想。国外Mem0针对AI记忆技术发表论文并开源,提出Mem0Mem0g两种方案,在不同场景表现出色,已获多应用,还提供SaaS服务。

AI与安全
新闻资讯7

高盛上调腾讯目标价,AI 人才的核心投资选择

高盛上调腾讯目标价,因其业绩强劲且AI推动各业务线增长。腾讯2025年AI应用爆发,投入专利向好。还提到行业AI人才需求大,腾讯有特别升级的AI产培项目,介绍了投递要求福利。

特工宇宙