「多模态体验」共找到 1611 篇相关文章
DeepSeek之后:中国开源人工智能生态的架构选择
自2025年1月“DeepSeek时刻”,中国开源社区有历史性进展,讨论焦点从模型转向架构与硬件选择。技术架构多元,多模态能力扩展,开源许可宽松,小模型走红,本土硬件采用加快。
在上海!邀你踏入“未来分身术”的沉浸世界
2025年9月26日14:00,MANA在上海the point空间邀你体验“未来分身术”。艺术家赵博雄会带来“分身术”艺术实验,还介绍了数字艺术分身术在公共文化、演出等方面的价值及活动流程和参与方式。
NeurIPS 25开新坑:145万个图文对,覆盖八种主流水下理解任务
华中科技大学团队推出首个水下多模态大模型NAUTILUS,支持8种水下场景理解任务,还开源145万图文对的NautData数据集。模型通过VFE模块解决水下图像问题,性能超越现有模型,恶劣环境表现更佳。
Claude Skills很重要
作者本想退订Claude,因Anthropic发布Claude Skills改变主意。它是‘能力包’,含SOP、工具和资源,分层加载省上下文窗口。预设Skills可体验,官方开源,模块化设计利于挂载和按需加载,或形成Skills Market。
李飞飞最新长文火爆硅谷
AI教母李飞飞发表长文,首次系统性解释空间智能,提出真正具有空间智能的世界模型须具备生成、多模态、交互三个核心能力,还分享World Labs进展及世界模型在多领域的潜力。
告别Transformer,重塑机器学习范式:上海交大首个「类人脑」大模型诞生
上海交通大学团队发布首个「类人脑」大模型 BriLLM,脱离传统 Transformer 架构限制。它基于 SiFu 学习机制,有可解释性、能无限处理上下文等优势,还支持多模态融合,已获交大重点项目资助。
让 AI 推荐美食,字节悄咪咪上线“AI 版美团”
字节跳动悄然上线AI产品「探饭」,可在抖音小程序体验。它能智能推荐美食餐厅,有AI问答、评价总结、点菜等功能,餐厅信息全,支持团购和外卖,还能比店PK。
让ChatGPT连读“A”,直接崩溃到念广告词,网友:拿付费用户做测试呢?
ChatGPT付费用户体验高级语音模式时遇怪事,正常聊寿司时突然插播广告,连读“A”也会如此。网友猜测是广告插入或“幻觉”,OpenAI技术人员称是幻觉,而国产AI无此问题。
李飞飞刚发Atlas,中国开源“同款”已抢跑半年?
9月2日,李飞飞团队发布多模态世界模型Atlas,引发好评。而国内影溯3月就开源InSpatio - World模型,有类似能力。影溯登顶权威榜单,还联合启动大规模空间智能3D数据开放计划。
AI「解码」古罗马,重现千年铭文真相!DeepMind新模型再登Nature
借助DeepMind推出的生成式AI工具Aeneas,考古学家面对古代碑文不再抓瞎。它是多模态生成式神经网络,能助历史学家解读、归属和修复残缺文本,还可适应其他古代语言、文字和媒介。