「视频转博客」共找到 1183 篇相关文章
ICLR神秘论文曝光!SAM3用「概念」看世界,重构视觉AI新范式
2023年Meta推出SAM,后SAM 2扩展到视频分割。近日,SAM 3现身ICLR 2026盲审论文,带来「基于概念的分割」新范式,强调按「语义概念」理解和分割图像,还构建数据引擎提升性能。
听说,大家都在梭后训练?最佳指南来了
大模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。
冲上 GitHub 热榜,这个智能问数开源项目火了!
数据使用麻烦,存在“数据鸿沟”。开源项目SQLBot基于LLM和RAG技术,能用大白话查询数据库,将问题转成SQL执行并可视化呈现结果,功能实用,部署简单,降低了数据分析门槛。
一致性对标Nano Banana,国产Vidu Q1同时支持7张参考 | 实测
AI生图赛道竞争激烈,专注视频大模型的Vidu推出Q1参考生图模型,能同时支持7张参考图,主体一致性对标谷歌Nano Banana。实测玩法多样,有高可操作性,现已全球同步上线。
Cursor只排第6!136国用户实测25款AI编码工具,第一名73%胜率,还是个新面孔
Design Arena评测平台用对抗式评测方法,让用户对AI模型生成的设计作品投票,评估其设计美学表现。文章总结了上榜的编码工具,如new.website胜率约73%排第一,还对比了不同类型模型的排名情况。
一个国产AI视频产品如何吸引全球6000万用户?|甲子光年
文章围绕爱诗科技旗下AI视频产品PixVerse展开,讲述其吸引全球6000万用户的历程。介绍创始人王长虎两次技术路线转型,先做To C再推API,还谈及B端业务场景及‘拍我AI’国内上线等情况。
家用人形机器人,终于快要来了
作者认为除关注AI大模型进展,更期待家用机器人突破。如今具身智能已具备落地条件,像特斯拉、1X等公司在人形机器人领域有进展,作者乐观预计五年内人形机器人能成熟。
Gemini新手教学
最近Google推出教育优惠,可免费使用15个月含Gemini Advanced等在内的AI产品。作者分享使用Gemini经验,指出其在上下文长度和生态打通方面优于ChatGPT,老牌厂商家底足,OpenAI下半场有压力。
14.9k Star!Firecrawl 开源的 PDF 智能分类器,200 份文档 0.47 秒搞定!
Firecrawl 开源 PDF 智能分类与文本提取库 pdf-inspector,已获超 1.4 万人标星。它能智能分类、感知提取、转 Markdown 及按需路由,性能炸裂,分类快,多项指标领先,还支持多平台。
“现代 AI 九成突破都来自我们!”面对核心团队被挖,谷歌 DeepMind 掌门人的回应挺硬
谷歌股价下跌,核心团队被挖,引发对其大模型地位的担忧。但 DeepMind 创始人哈萨比斯回应有底气,谈技术观点,如靠文本模型难以实现 AGI,智能需理解物理世界,还提及水印、创意等问题。