「通用文本嵌入」共找到 1290 篇相关文章
鹿明机器人CEO喻超:2026年目标营收过亿,但更关注通用智能的终局
鹿明机器人成立不到一年就凭借人形机器人LUS破圈。2026年其计划建成超100万小时UMI数据采集产能,预期营收过亿,但CEO喻超更关注通用智能终局,认为人形机器人是终极方案。
字节发布通用游戏智能体!5000亿token训练,用鼠标键盘吊打GPT-5!
字节seed团队打造通用游戏智能体Game-TARS,基于键盘—鼠标动作空间训练,用超5000亿标注量级数据,结合新技术提升扩展性和泛化性,在多类游戏任务中表现超越GPT - 5等模型。
机械手真正「活」了,银河通用&清华推出DexNDM,用神经动力学重塑灵巧操作
银河通用与清华推出DexNDM,旨在解决灵巧操作技能sim - to - real难题。它能让灵巧手掌握多种转轴、多样手腕朝向下旋转物体的技能,构建的半自主遥操系统可完成复杂工具操作和长程装配任务,在sim - to - real方法上有创新。
腾讯开源混元Image 2.1:2K高清+完美文字嵌入,图文天花板来了
今天凌晨,腾讯开源最新图像模型混元Image 2.1,支持原生2K分辨率与长提示词,文字嵌入能力强,适用于专业场景。还开源加速版模型权重和提示词改写模型,评估显示其性能达开源最优,接近闭源商业模型。
单条演示即可抓取一切:北大团队突破通用抓取,适配所有灵巧手本体
在灵巧手通用抓取研究中,传统强化学习面临挑战。北大及BeingBeyond团队提出DemoGrasp框架,以一次成功抓取演示轨迹为起点,通过编辑轨迹适应不同物体与姿态,提升学习效率和真机性能,实验效果出色。
一图胜千言被实现了!DeepSeek-OCR用图片压缩文本,10倍压缩率
DeepSeek开源DeepSeek - OCR,用图片压缩文本达10倍压缩率且几乎不丢信息。它解决了以往视觉编码器的问题,架构清晰,数据丰富,性能测试亮眼,为解决大模型‘记性差’问题提供新思路。
Qwen3深夜开源新系列:文本表征模型,3种尺寸可选,超越商业API拿下SOTA
Qwen3深夜上新Embedding系列,专为文本表征等任务设计,在Qwen3基础模型上训练,有0.6B/4B/8B三种尺寸,8B版本在MTEB榜单排第一,性能超商业API,已在多平台开源。
谷歌AGI底座降临!首个原生全模态嵌入模型上线,已实现全模态SOTA
谷歌发布首个原生全模态 Embedding 模型 Gemini Embedding 2,将文本、图、音视频及 PDF 融于统一向量空间,实现跨模态检索,降低架构成本,赋予 AI 连贯「记忆」,是重塑 AI 基建的里程碑。
厉害了,智谱造了全球首个手机通用Agent!人人免费,APP甚至直接操控云电脑
智谱发布全球首个手机通用Agent AutoGLM,免费且人人可用。它可在云端执行任务,不占本地资源,还能操控云电脑。能集成到多种载体,上线移动端API申请通道及开发者生态共建计划。
模力工场 035 周 AI 应用周榜:AI 正在走出通用叙事,进入细分人群与真实场景
模力工场 035 周 AI 应用周榜揭晓,前十应用展示 AI 向各领域渗透,正从通用大模型转向垂直细分场景。本周上榜应用呈现多趋势,如情绪陪伴类细分、内容生产类下沉、营销商业化具象化等。