「多模态聊天 App」共找到 1374 篇相关文章
夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26
在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。
我想给 OpenClaw 接上语音,结果有人先做了
作者一直想用语音对接 OpenClaw,却发现「光帆AI」团队已朝此方向发展。他们用 APP 跑通「耳机 + 服务」链路,后续将迁移到硬件。作者体验后觉得交互爽,还介绍了接入方法、安全模式等。
给 iPhone 装个“最强本地大脑”:Google 开源模型 Gemma 4
Google 4 月初发布开源模型 Gemma 4,可离线运行在 Google AI Edge Gallery 上。它在多项基准表现出色,采用 Apache 2.0 协议,开发者可集成到 App。还介绍了在 iPhone 离线使用方法及适用场景。
AI三国杀!OpenAI狂卷,DeepSeek封神,却被Mistral偷了家?
中美忙着堆算力打AI战,欧洲Mistral杀出,推出Large 3和Ministral 3,全开源、多模态、能落地。Large 3规格高,Ministral 3小而强,可跑在多设备上。Mistral还想成平台,挑战巨头。
字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法
近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。
AI 领域最''不务正业''的团队,可能做了一件最正确的事
马卡龙是一款主打帮助用户更好生活的个人智能体,有深度记忆和生成定制化生活场景小应用两大核心特点。它区别于生产力智能体,有技术积累,基础聊天免费,开发小应用收费。
跟Claude谈个恋爱怎么了?Nature最新研究:真能给人聊傻了
Nature旗下研究指出,聊天机器人持续顺着、理解、陪伴用户,可能让正常人怀疑现实。研究总结出“放大螺旋”框架,含语言镜像、超个性化、谄媚三组件,叠加会成妄想放大机。OpenAI也关注此问题。
5年博士1年读完,20分钟干完48小时教授工作!这个工具在硅谷火了
新智元报道,Claude Code正重新定义编程。顶级开发者用它写代码,零基础小白10分钟做出App,教授20分钟完成48小时工作量。它理解项目上下文,自动设计、生成、测试代码,普通人用自然语言提需求即可。
无需租GPU,一台24GB内存的笔记本就够了!
阿里开源稀疏 MoE 模型 Qwen3.6-35B-A3B,总参数 35B,激活 3B。它在智能体编程上超越前代,可与稠密模型媲美,支持多模态,已在 Qwen Studio 上线,还能集成第三方编程助手。
清华开源|做一门课要3天?用 OpenMAIC,30分钟生成完整互动课堂|GitHub 15.6k
OpenMAIC 是清华开源的 AI 互动课堂平台,能将主题或学习材料快速转化为完整互动学习体验。它把课堂拆成多种交互组件,架构设计出色,支持多 LLM 服务商,还能在聊天应用生成课堂。