「功能体验」共找到 2116 篇相关文章
港大开源视频版RAG,像聊天一样看完百小时纪录片。
港大HKUDS团队开源超长视频理解框架VideoRAG,突破传统模型时长限制,支持对数百小时视频精准检索和问答。还有桌面应用Vimo,使用简单高效。介绍了其切片索引、混合检索、生成回答的实现逻辑。
刚刚,OpenAI发布首个AI浏览器ChatGPT Atlas!谷歌最怕的来了
OpenAI发布AI浏览器ChatGPT Atlas,原生嵌入ChatGPT,有侧边栏、浏览器记忆与智能体模式,可在页面内理解意图并完成任务。谷歌股价应声下挫,AI浏览器之战升温。
谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%
昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。
百度文库网盘发布 GenFlow2.0,支持同时调用超 100 个专家智能体
8月18日,百度文库联合百度网盘发布全球首个全端通用智能体「GenFlow2.0」。它支持超100个专家智能体并行工作,解决描述难、等待久等问题,还打通百度生态资源,兼容MCP协议,接入荣耀智能助理。
凌晨战神Qwen又搞事情!新模型让图像编辑“哪里不对改哪里”
Qwen团队发布Qwen-Image-Edit,作为Qwen-Image20B图像编辑版,能精准修改文字,还可新增、消除、重绘、修改元素,支持IP编辑、视角切换等玩法,在多方面表现出色。
谷歌版小钢炮开源!0.27B大模型,4个注意力头,专为终端而生
谷歌开源Gemma 3 270M,几分钟就能完成微调,性能超Qwen 2.5同级模型。此模型小巧高效,可本地运行,还能用它构建OCR应用。它有多项亮点,适合多场景,上手简单。
AI「解码」古罗马,重现千年铭文真相!DeepMind新模型再登Nature
借助DeepMind推出的生成式AI工具Aeneas,考古学家面对古代碑文不再抓瞎。它是多模态生成式神经网络,能助历史学家解读、归属和修复残缺文本,还可适应其他古代语言、文字和媒介。
ChatGPT大更新推出学习模式!“一夜之间1000个套壳应用又死了”
ChatGPT大更新,推出学习模式,像老师般引导思考,对多类用户开放。它由OpenAI与多方合作打造,结合学习科学成果。目前用提示词实现,未来会训练进模型,还将多方面改进,或重塑教育模式。
一键搞定双语播客的项目,效率+200%,太6了!
文章介绍开源项目Twocast,它是AI播客生成器,能模拟双人自然对话,3分钟产出一期播客。有双人对话、多输入、多语言等特色,提供两种安装方式,适合多类人群。
首钢冰球馆迎来热血少年,robotex世界机器人大会京津冀选拔赛即将举办
7月27日,第25赛季robotex世界机器人大会京津冀选拔赛北京站将在首钢冰球馆启幕。robotex赛历史悠久、影响大,2017年落地中国。首钢冰球馆是多功能场馆,举办过众多赛事和活动。