信息获取场景」共找到 2623 篇相关文章

开源动态8

首个企业级智能体全开源!京东云将Agent门槛直接给打没了

京东云JoyAgent成为首个100%开源企业级智能体,完整能力全部开源,企业开发者可本地独立部署。它多智能体协同能力强、性能一流,还具多项技术创新,解决了企业AI落地难题。

量子位
产品应用8

马斯克AI女友直播「一秒变身」,Karpathy看完立刻投钱

世界首个支持直播推流的「实时」扩散AI视频模型MirageLSD诞生,大神Karpathy亲自站台。它能理解真实视频后同步生成AI视频,实现零延迟、无限时长、每秒24帧不卡顿,给视频娱乐和直播互动带来丰富想象。

新智元
算法论文7

ICLR 2025新成果:文档检索“降本增效”,从此“开挂”

传统文档检索系统处理视觉信息丰富的文档存在瓶颈,ColPali方法直接从文档页面图像生成多向量嵌入,简化流程、提高性能、降低延迟。ColQwen - Omni在其架构上扩展到图文+音频多模态匹配。

CourseAI
产品应用7

解读Qwen3文本嵌入与重排序技术版图

文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。

CourseAI
推荐文章7

CUTLASS CuTe GEMM细节分析(一)——ldmatrix的选择

作者作为CUTLASS CuTe初学者,记录问题分析过程。本文聚焦如何基于TiledMMA及输入矩阵在Shared Memory上的Layout选合适Copy Operation完成拷贝,结合实例讲解ldmatrix指令选择,还给出参考代码。

GiantPandaLLM
8

重磅发现!大模型的「aha moment」不是装腔作势,内部信息量暴增数倍!

中国人民大学等联合团队研究发现,大模型推理有“信息脉冲”,特定步骤互信息值飙升形成“互信息峰值”,对应“思考词汇”。基于此提出无需额外训练提升推理性能的方法,代码已开源。

机器之心
产品应用7

Alibaba力作:Ovis-U1 融合理解、生成与编辑,解锁无限可能

OpenAI 2025 年推出的 GPT - 4o 结合图像与语言能力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型能完成理解、生成与编辑任务,介绍了其架构、训练过程和应用。

CourseAI
产品应用7

从输入指令到代码落地:Cline AI 源码浅析

文章从源码角度剖析 Cline AI 将自然语言指令转化为编程任务的过程,包括启动调试、前端输入、主进程处理、任务初始化、构建提示、模型请求等环节,指出核心是 prompt 组装和 tools 调用。

阿里云开发者
产品应用7

数据库厂商入局AI又有新思路,OceanBase选择“卖铲子”

国产数据库厂商 OceanBase 入局 AI 有新思路,近期动作频频。其云数据库业务 OB Cloud 实现 AI 能力开发部署并与多平台集成,已在多行业落地。副总裁尹博学谈其 AI 战略逻辑、面临挑战及未来趋势等。

InfoQ
新闻资讯7

泪目!靠AI让爷爷「复活」,他拿下红杉1600万刀?要让所有地球人数字永生

国外14人团队Delphi获红杉领投1600万美元A轮融资。其产品源于创始人想复活中风祖父,现成长为“数字思维图书馆”。2023年12月测试版上线,有人靠它年入百万,未来想服务大众。

新智元