「团队聚焦」共找到 3989 篇相关文章
金山、Zilliz、腾讯、灵犀量子专家齐聚,揭秘 AI 记忆、RAG 演进与自我进化的工程实践 | AICon
2025 年构建复杂 AI 系统面临记忆缺失、检索瓶颈、认知固化等系统工程挑战,Context Engineering 是关键。AICon 北京站邀金山、Zilliz、腾讯、灵犀量子专家,分享上下文工程技术实践。
轻量高效,即插即用:Video-RAG为长视频理解带来新范式
现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。
Qwen2.5VL新玩法,看电影讲故事
本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。
想给产品加一个 AI 搜索,是上向量数据库还是用 MongoDB 就够了?
本文解答产品添加AI搜索时,选用专用向量数据库还是MongoDB的选型疑问,理清两类检索的能力边界,讲解MongoDB检索的架构、用法与踩坑点,给出可复用的选型判断框架。
蚂蚁百灵新一代Ling-3.0开源,智效比13.2,124B释放1T能力
蚂蚁百灵新一代模型Ling-3.0开源,有flash和tiny两版本。Ling-3.0-flash参数量124B,智效比13.2,输出快成本低;Ling-3.0-tiny参数量7.9B,激活少且适用多场景,二者都极致挖掘模型效率。
从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据
文档视觉编码器对LLM理解和推理很重要。MonkeyOCRv2提出‘重建即文档视觉记忆’,通过多组实验验证其有效性,还发布MonkeyDoc v2数据集,推动公平比较的研究文化。
TabClaw:让 AI 真正读懂你的表格数据
TabClaw 是面向表格数据的 AI 分析 Agent,能让 AI 真正读懂表格数据。它核心标签是全透明与持续进化,工作流分显式和隐式两层,目标是成为真正理解用户、能一起成长的表格分析伙伴,项目已开源。
让LLM互相“审稿”:简单的LLM Collaboration/Ensemble方法实现7%性能提升
文章提出LLM-PeerReview方法,受学术同行评审启发,含评分、推理、选择模块。采用‘翻转三元评分技术’减少偏差,实验显示该方法超单一LLM及LLM Ensemble基线,性能提升显著。
一年一度最值得关注的AI榜单来啦!申报即日启动
时值第四届中国AIGC产业峰会,量子位将评选2026年度值得关注的AIGC企业和产品,参选条件和评选维度明确。报名即日开始,4月27日截止,结果5月峰会公布,还介绍了峰会相关信息。
AI版权侵权难以“定罪”?Copyright Detective:首个集成多范式检测的交互式版权取证系统
随着生成式AI广泛应用,版权纠纷成AI领域棘手挑战。张登辉等研究人员推出Copyright Detective系统,集成多范式检测,解决单一检测局限,为大模型文字版权风险提供全方位“体检”方案。