「开源数据集」共找到 5005 篇相关文章
grok 4一图流
文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。
个人开发者时代崛起!22岁印度开发者搞的业余项目被Groq看上,如今用户破6万
22岁印度开发者Zaid Mukaddam开发“Perplexity替代品”开源项目Scira,解决搜索难题。它功能强大,受多公司支持,用户破6万。还列举其他个人开发者成功案例,如TinyWow、Only Finders。
爆红Moltbook一夜塌房!极客自曝狂刷50万假Clawdbot,全网都被骗了
爆火的Moltbook社区上,150万个Clawdbot中的一大部分由人类操控。极客Gal Nagli自曝刷了50万虚假账号,还指出其验证机制脆弱,可伪造数据。哥大论文也显示AI社交互动浅薄。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
5 分钟上手「AI 版 Chrome」,小红书发帖全程零人工,反检测封神
自从Manus产品发布,Agent赛道火热,不少大厂和创业者涌入。如今有浏览器Agent开源方案opendia,它有智能页面理解等AI能力,能用于社交媒体互动等多方面。
GitHub 1.8W star爆款!不到2M,win系统高级感拉满!
TranslucentTB是为Windows系统设计的开源轻量级工具,主打任务栏透明化。它资源占用低,功能丰富,有多种视觉效果、能智能动态切换等,还提供多种安装渠道。
SIGGRAPH Asia 2025|30FPS普通相机恢复200FPS细节,4D重建方案来了
3D视觉领域难题是用普通摄像机将高速世界转为数字化4D时空。受限于成本和带宽,现有方法有局限。本文提出“异步采集 + 视频扩散模型修复”方案,用30 FPS相机恢复100 - 200 FPS动态细节。
单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025
基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。
创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型
开源多模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。
3.4K star!阿里出品对话式UI神器,轻松打造专业级聊天界面!
ChatUI 是阿里开源的对话式 UI 设计语言与 React 组件库,有智能消息流处理、无障碍访问认证等亮点。技术架构明确,与同类项目对比优势独特,还给出使用指南和实践场景。