视觉领域」共找到 2295 篇相关文章

产品应用8

让问题不过夜:交易领域“问诊”Agent实践

文章针对研发支持中的痛点,构建智能Agent系统,将问题抽象为业务答疑与问题诊断两类能力。介绍了系统架构、构建演进、知识体系、质量评估等内容,还展示实战成效,指出当前边界与下一步方向。

阿里云开发者
产品应用7

Resolve AI:为什么 AI SRE 领域有望诞生下一代 Datadog

文章分析了 AI SRE 领域发展现状,指出运维侧 AI 变革慢于开发侧。介绍了 Resolve AI 产品,包括多 Agent 机制、应用场景等,还提及融资、客户情况,对比了与 Traversal 差异,探讨了 AI SRE 未来趋势。

海外独角兽
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。

机器之心
产品应用7

汤森路透发布AI Agent,专用于税务、审计等财务领域

全球著名商业服务平台汤森路透发布面向财务专业人士的AI Agent——CoCounsel,能自动执行复杂业务流程任务,支持人机协作。其开发耗时超1年,早期客户满意度高。后续还将推新应用并扩展功能。

AIGC开放社区
推荐文章7

AI领域并无真正的新想法,只有新的数据集

作者Jack Morris认为AI虽进步明显,但范式转变级突破不多。大语言模型四次关键突破底层理论早已有之,新在于数据。改变数据比调整模型或算法作用更明显,推动AI进步应找新数据,如YouTube或具身化数据。

宝玉AI
算法论文8

Nature子刊:攻克医疗器械「看不清」难题,赋予自动驾驶视觉

MicroSyn-X首创无需真实数据的AI合成影像技术,让机器在无标注虚拟X光中学会追踪微型手术器械,突破医疗数据稀缺瓶颈,为自动化微创手术提供新路径,且代码和数据已开源。

新智元
产品应用7

南京艺术学院人工智能与计算机视觉算法创新设计成果展示

南京艺术学院‘人工智能与计算机视觉算法创新设计工作坊’汇集师生与专家成果,涵盖多种艺术形式。学生学习多技术完成跨媒体作品,如以《大闹天宫》为蓝本的交互装置,还有探索情绪、文化等主题的作品。

MANA新媒体艺术站
新闻资讯7

多模态 +Agent 在培训与教育领域的应用|QCon 北京

4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。北银金科尹辰轩将分享《多模态 + Agent在培训与教育领域的应用》,探讨多模态模型推动AI场景扩充等内容。

InfoQ
产品应用8

360发布全球最强视觉语言对齐模型!榜单全面领先!

360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。

AIGC开放社区
算法论文8

告别「边画边说」:LatentMorph 开启视觉生成隐式潜空间推理新范式

现有的文生图模型缺乏动态思考与自我修正能力,香港科技大学团队提出LatentMorph框架,将隐式潜空间推理集成到T2I生成过程中,实验显示其显著提升基座模型性能,削减推理延时与Token消耗,实现人机认知对齐。

机器之心