视觉语义场景补全」共找到 2600 篇相关文章

产品应用7

Jina 第4版:多模态向量检索,统一适配,挑战3大任务

Jina第4版基于Qwen2.5 - VL模型扩展,支持单向量和多向量输出。它经对比学习和任务特化训练,推理时可按需选LoRA适配器,能利用多模态处理能力优化不同任务性能。

CourseAI
产品应用8

终于有AI视频模型,解决了体操难题。

前天深夜MiniMax发布Hailuo 02视频模型,虽未正式上线但放了预告片。该模型能生成杂技动作,解决了体操难题,在复杂动作肢体表现上吊打其他模型,还支持原生1080P,价格便宜。

数字生命卡兹克
产品应用7

Cursor 定价更新:Pro 不再限 500 次,取消工具调用限制,还推出 $200 Ultra。

Cursor进行定价更新,推出200美元/月的Ultra计划,使用量是Pro的20倍。Pro计划默认改为有速率限制的无限请求,也能切换回旧的500次快速请求模式。还推荐了4个开源LLM微调库。

AI进修生
新闻资讯7

这届机器人太会了!百事蓝宝出道,人形机器人也开始卷情绪价值了

百事可乐首个人形机器人「百事蓝宝」出道,与贝克汉姆等互动表演。AI和硬件进步使机器人走入生活,它迎合年轻人情绪价值需求,其诞生是百事与智元价值共振,未来将创造更多惊喜。

新智元
算法论文8

ICRA 2025|通用多机器人长时任务规划框架破解任务分配难题,成功率+105%、效率+36%

2025年5月,美两校联合团队在ICRA 2025发布LaMMA - P。它融合大模型与PDDL规划器,解决异构多机器人长时任务分配难题,在新基准数据集上,相比SMART - LLM,任务成功率提高105%,执行效率提升36%。

机器之心
开源动态8

图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025

360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。

AI科技大本营
开源动态8

一行 Python,生成绝美城市地图海报!

开源君发现宝藏项目`prettymaps`,这是巴西开发者Marcelo Prates的开源作品,能从OpenStreetMap拉取数据画定制地图。它功能丰富,安装简单,可让普通人轻松进行地图视觉创作。

开源先锋
推荐文章7

分享一些可以让AI使用更丝滑的小技巧

作者起初用AI不顺手,经研究摸索发现是指令有误。分享沟通技巧,如给身份、给参考风格、用“说人话”“举例子”,还可当头脑风暴搭子,强调清晰指令能助自我认知。

每日豆瓣
推荐文章7

Fable 5 订阅权限又续了 5 天!与其被吊着,我找了个账单只有 1/3 的替代方案

Anthropic将Fable 5订阅权限延长至7月12日,但使用不稳定且价格贵。作者介绍OpenSquilla 0.5.0 Preview,其多模型集成协作方案用国产模型组队,成本低且分数可与Fable 5打平,不过也有适用边界。

花叔
开源动态8

7.3K Star!用 Orca 组建 AI 舰队:让 Claude Code 和 Codex 同时开工!

Claude Code 大火后,多家大厂推出自家 Code CLI,多终端操作上下文切换成本高。Orca 是开源 AI 编排器,可让多个 AI 编程助手并行工作,集中查看结果,有并行工作区、统一管理界面等亮点。

开源星探