通用视觉感知系统」共找到 1584 篇相关文章

算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
新闻资讯8

【展讯】不止观看:澳门当代摄影展|三影堂北京

本次《不止观看:澳门当代摄影展》汇集孙彦等13位澳门艺术家的创作,他们突破传统影像边界,将澳门多元文化转化为视觉文本。展览作品探讨摄影与城市、文化、技术等关系,呈现从传统到AI的多元脉络。

三影堂摄影艺术中心
新闻资讯7

AI也能换岗了!Anthropic教智能体交接班,不怕长任务断片

Anthropic设计出长时智能体运行框架,让AI跨越数小时任务渐进式推进。其采用双智能体架构,结合环境管理方法,提升全栈Web应用开发稳定性,但仍有通用与多智能体架构选择等开放问题。

新智元
新闻资讯8

ImageNet作者苏昊被曝任教复旦

ImageNet作者之一苏昊被曝要去复旦任教。他是具身智能领域论文被引次数最高的华人学者,主导多个奠基级项目。他研究从语言到2D、3D视觉,再到机器人,还创办具身智能公司Hillbot。

量子位
开源动态8

腾讯混元发布并开源图像模型 2.1,支持原生 2K 生图

9月9日深夜,腾讯发布并开源混元生图模型“混元图像2.1”,支持原生2K高清生图,综合能力领先。它在多方面升级,有诸多亮点,评估显示效果优,还同步开源文本改写模型,能满足多样视觉需求。

InfoQ
算法论文8

统计可控数据合成!新框架突破大模型数据生成局限,麦吉尔大学团队推出LLMSynthor

麦吉尔大学团队提出新方法LLMSynthor,让大模型成结构感知的数据模拟器,为隐私敏感、数据稀缺场景生成不泄密的高质量替代数据。它通过结构推理、统计对齐等步骤实现,有理论保障,多场景实测效果佳。

量子位
开源动态7

OpenClaw构建自我迭代AI助手笔记

作者花3天体验OpenClaw,构建银行客户经理助手场景,验证通用智能体框架可用性。介绍Agent构建、迭代、交流及评估能力构建过程,对比OpenClaw与Claude Code、OpenViking,指出记忆系统问题,肯定专属智能体提升生产力的可行性。

阿里云开发者
新闻资讯7

为Token付费是一件很愚蠢的事情,用户应该为智能付费丨RockAI刘凡平@MEET2026

RockAI创始人刘凡平在量子位MEET2026大会提出,AI下一阶段要让模型“活起来”,实现硬件觉醒。他认为为Token付费愚蠢,应关注端侧智能,突破Transformer和反向传播算法,群体智能是迈向通用人工智能新路径。

量子位
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期在多赛事表现出色。

AI寒武纪
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。

Agent的潜意识