「高质量数据集」共找到 4314 篇相关文章
单目3DGS迎来突破:影石开源UniSHARP实现全相机适配
影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。
1.5K Star!网页提取神器 webclaw:让 AI 精准抓取网页核心内容!
webclaw是专为AI工作流打造的高性能网页提取工具,能把网页转成适合大模型的内容。它有Token优化、极速响应等亮点,支持多种安装和使用方式,解决了传统抓取工具的痛点。
《生化危机》女主演跨界AI拿SOTA了!打造免费“AI记忆系统”爆火GitHub
《生化危机》女主角Milla Jovovich与程序员老友及Claude合作,打造开源免费的AI记忆系统MemPalace。该系统在多项测试中成绩优异,采用“记忆宫殿法”,检索效率提升34%,还设计了AAAK语言,成本低且精度高。
突发!阿里Qwen深夜地震,林俊旸官宣「下台离开」
深夜,Qwen负责人林俊旸宣布离开Qwen团队,未透露去向和接任者。他是阿里最年轻P10技术高管,跨学科背景,在阿里6年连升四级,推动Qwen开源模型发展,还关注AI未来。
清华AI找药登Science!一天筛选10万亿次,解决AlphaFold到药物发现的最后一公里
清华大学团队在Science发表论文,研发AI驱动的超高通量药物虚拟筛选平台DrugCLIP。它24小时能完成10万亿次蛋白–分子配对计算,打通从AlphaFold到药物发现通道,完成人类基因组规模筛选,数据已开放。
SEO->GEO?大模型时代如何构建人类获取信息新范式
文章指出百度信息入口根基被侵蚀,或被DeepSeek替代。还阐述互联网大势格局,如基模最终收敛,互联网盈利模式从用户免费-营销付费向用户付费转变,高价值真实信息将重构互联网。
一觉醒来,GitHub没了?CEO辞职,微软接管,开发者天塌了
GitHub CEO Thomas Dohmke宣布辞职,GitHub将不再独立运营,整体并入微软新成立的CoreAI工程集团。微软不再为其找新CEO,由多位微软高管分管。GitHub将成微软AI时代‘武器库’。
AI的新技能不是提示词,而是上下文工程
最近,“上下文工程”在AI领域备受关注,人们讨论焦点正从“提示词工程”转移至此。构建有效AI智能体的秘诀在于提供的上下文质量,而非代码复杂程度,这正是上下文工程的意义。
20种机器人本体通吃!蚂蚁新一代VLA具身大脑刚刚开源了
2026 年具身智能 VLA 受关注,蚂蚁灵波发布新一代具身基座模型 LingBot-VLA 2.0,支持 20 种机器人构型,多方面能力提升,开源模型权重等,从架构、数据、后训练解决跨本体难题。
LinkedIn 重构服务发现:在大规模环境中用 Kafka 和 xDS 取代 Zookeeper
LinkedIn 工程博客中,Bohan Yang 介绍升级基于 ZooKeeper 的传统服务发现平台项目。因传统系统有扩展性问题,团队开发新架构,分离读写路径,实施双读双写机制,迁移后数据传播延迟显著改善。