多视角」共找到 4258 篇相关文章

开源动态8

谢赛宁等推出统一模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源

谢赛宁等团队推出统一模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比种设计方案,确定CLIP + Flow Matching最佳,模型在任务测试表现卓越且全开源。

量子位
新闻资讯7

1/8成本比肩Claude 3.7,Mistral Medium 3来了

“欧洲OpenAI”Mistral AI发布模态新模型Mistral Medium 3,主打编程和模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。

量子位
新闻资讯7

AI可观测行平台Lightrun,获7000万美元

AI可观测性平台Lightrun获7000万美元B轮融资,由Accel和Insight Partners领投。它改变传统监测工具局限,实现实时调试修复。连续三季成G2领域领导者,获众企业信赖,发展迅猛。

AIGC开放社区
新闻资讯8

从李飞飞到朱军,世界模型为什么都开始走向机器人|甲子光年

本文报道近期位AI领军者均将世界模型研究转向机器人领域,梳理了朱军团队通用世界模型的五级技术路线,解析世界模型从生成世界走向真实行动的核心逻辑与行业趋势。

甲子光年
新闻资讯9

27岁研究员连辞OpenAI、Anthropic!两家都在拿我们的命下注

本文报道GPT-4o核心贡献者Jacob Coxon接连从OpenAI、Anthropic辞职并退出AI行业,批判头部AI机构陷入竞速赛,罔顾超级智能失控风险,直指行业需共同踩刹车。

新智元
新闻资讯8

首批GPT-6内测结果好离谱啊。。。

GPT - 6使用资格分批开放,内测玩家抢先体验。其在3D生成、游戏开发、网页制作等领域表现出色,如15分钟做出Mac应用,空间推理达世界级水平,但运行时Token消耗大。

量子位
算法论文8

T-RO综述重构Foundation Model时代机器人操作知识版图

近日,论文《Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives》被IEEE Transactions on Robotics接收,它以High - Level Planning和Low - Level Action Modeling为主线,梳理Foundation Model时代机器人操作发展,分析了现存问题及关键缺口。

机器之心
产品应用7

马斯克的 Grok Bot 正在吞掉电脑,买 Mac mini 的事可以先缓缓

重度使用 Codex 大半年,电脑不堪重负,Agent 任务增让本地电脑成瓶颈。Grok Bot 将 Agent 工作搬到云端,配云电脑,解决本地硬件难题,还为 Bot 分配独立屏幕,实现人机电脑分工。

AI产品自由
算法论文8

给文档质量"打分":DIQA-5000 数据集与融合版面语义的 DocIQ 质量评估模型

文档图像质量评估(DIQA)是评判‘增强算法有没有把图变好’的关键工具。过去研究围绕自然图像,缺文档专用数据集。本文提出DIQA - 5000数据集和DocIQ模型,补齐缺口。

机器学习AI算法工程
开源动态8

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

香港大学、香港科大与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,方面表现获改善。

机器之心