创新方法」共找到 2358 篇相关文章

开源动态8

社区供稿 | 开源多模态大模型新突破,书生·万象3.5发布,通用能力、推理能力与部署效率全面升级

2025年8月26日上海AI实验室开源发布书生·万象InternVL3.5,通过创新技术实现推理、部署和通用能力全面升级。它有多种尺寸模型,多项性能领先,还加强了智能体核心能力,应用场景广泛。

Hugging Face
推荐文章8

Gamma 创始人:小团队创业是共识,怎么做好才是最大的问题

AI创企Gamma 30人服务近5000万用户,ARR超5000万美元且持续盈利。创始人Grant Lee分享创业心得,包括小团队组织模式、重视通才、可持续业务理念、组织创新及应对PMF等问题的思路。

Founder Park
算法论文8

告别单一大模型依赖!北航等机构发布综述:大语言模型集成(LLM Ensemble)

北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三大集成范式。

PaperAgent
开源动态8

首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」

港大团队提出FASTER,重新审视动作分块策略的反应延迟问题,提出快速动作采样方法。它即插即用,已开源。通过Horizon - Aware Schedule等创新,降低TTFA、提高闭环频率,实验显示能显著提升VLA反应能力。

机器之心
算法论文8

大象秒变挖掘机!三维变形新突破,无需额外训练 | CVPR'26

南京大学与北京大学提出MorphAny3D,无需额外训练即可让三维生成模型实现跨类别平滑变形。它通过创新注意力机制融合源与目标特征,精准控制结构与时序,效果远超传统方法,代码已开源。

新智元
产品应用8

灵码+Qwen3-Coder——使用Skill机制实现代码审核

本文探讨在灵码内使用Claude Skills能力,介绍其实现机制、灵码适配方案。还以代码审核场景为例,展示自定义Skill的创建方法,总结Claude Skills优势及应用场景,展望其与MCP的发展前景。

阿里云开发者
开源动态8

超越纯视觉模型!不改VLM标准架构,实现像素级深度预测

Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素级深度估计等任务,为多领域带来前景。

新智元
算法论文8

ICCV 2025 | 清华&腾讯混元X发现「视觉头」机制:仅5%注意力头负责多模态视觉理解

本文聚焦多模态大模型,提出基于 OCR 任务量化注意力头视觉偏好的方法,发现仅不到 5%“视觉头”主导视觉理解。还提出 SparseMM 策略优化 KV - Cache 资源分配,经多基准评测,性能和效率表现优。

机器之心
算法论文7

可解释性杀疯了!结合机器学习,发顶会轻轻松松!

在机器学习领域,模型可解释性愈发重要。结合XAI技术能提升模型透明度与可信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。

机器学习AI算法工程
推荐文章7

万字攻略|AI 时代,华人创业者进入日本市场的窗口打开了

Linkloud观察发现,AI浪潮下日本正为华人创业者打开窗口。虽日本市场慢且谨慎,但AI能盘活传统流程,客户忠诚度高。文章还从多方面给出创业建议,如产品要“补丁式创新”,先从ToC切入等。

Founder Park