「多视角数据」共找到 6010 篇相关文章
开源,本体驱动的GraphRAG新范式,零噪声~
分享开源项目trustgraph,重点介绍本体驱动的零噪声GraphRAG。常规GraphRAG在实际应用中问题多,如数据重复、冲突、缺数据等,而本体可构建自我完善的知识图谱,作者为此造了“本体驱动GraphRAG”。
Qwen3-LiveTranslate:视、听、说全模态同传大模型!
Qwen3-LiveTranslate-Flash 是基于大语言模型的多语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有多语言和方言支持、视觉增强等亮点,性能超主流大模型。
爬虫界“瑞士军刀”!开源高性能爬虫工具,实施进度监控、全栈SDK支持、n8n深度集成!
在AI驱动的数据时代,WaterCrawl是基于Python和Scrapy的开源网页爬虫工具,专为大规模数据提取和LLM优化设计,支持多语言内容抓取、实时进度监控和深度AI平台集成,优势显著。
爆火「开源投资框架」,AI时代的伯克希尔
AI投资虽火但常给出正确废话,AI Berkshire爆火,兼容Claude Code和OpenAI Codex,有18个Skill。它将四位投资大师方法论抽象成流程,通过多Agent协作完成投研闭环,还有强制给结论等特点。
LabVLA:当AI走进科学实验室,浙大x上海 AI Lab联合探索科学具身智能
浙江大学与上海人工智能实验室联合推出 LabVLA,探索更具泛化能力的科学具身智能范式。团队构建仿真数据引擎 RoboGenesis 与语料 LabEmbodied - Data,LabVLA 在多测试中表现良好,还将探索多场景应用。
当200位具身从业者被拉进同一个屋子
量子位等联合发起沙龙,近200位具身从业者探讨具身智能从实验室走进物理世界的问题。乐聚工程师指出具身数据瓶颈,蚂蚁灵波郑可成介绍模型,上海交大李永露分享评测基准,圆桌对话探讨数据挑战与破局路径。
仅有一位作者的论文,却补上了城市智能的「最后一公里」
郑宇教授用论文提出跨域多模态知识融合框架,在空气质量推断等多场景优势明显,其研究按数据选择等四阶段进行,解决数据难题,推动AI用于城市问题,为跨部门协作提供可能。
27、42、73,DeepSeek这些大模型竟都喜欢这些数!为什么?
技术作家发现GPT - 4o、Claude等模型猜数偏好42、73,Andrej Karpathy测试中模型多选27。网友猜测原因,如数据集、人类偏见等,也有论文分析此现象,多与数据分布有关。
LeCun出手,造出视频世界模型,挑战英伟达COSMOS
训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。
机器人的 GPT 时刻比我们以为的更近|AGIX PM Notes
文章认为机器人的 GPT 时刻可能比想象更近,未来 2 - 3 年或出现较通用机器人,3 - 5 年有望规模化部署。还分析了当前机器人发展情况、瓶颈及数据获取方式,同时介绍了上周市场动态和多家公司的 AI 相关事件。