「应用视觉团队」共找到 5585 篇相关文章
AAAI 2026|视频大语言模型到底可不可信?23款主流模型全面测评来了
合肥工业大学与清华大学团队推出视频大语言模型综合可信度评测基准 Trust-videoLLMs,对 23 款模型从五维度 30 项任务评测,揭示性能格局,指出模型现存问题,还开源评测框架等。
5.8K Star爆火!!在终端里开网页、刷视频、玩游戏,这操作真绝了!
介绍开源工具`term.everything`,它能在终端运行任何GUI应用,像浏览器、游戏等。该项目在GitHub获5.8K star,支持X11和Wayland应用,可远程使用,但画质和性能有局限。
一篇120页AI4Research(科学研究AI)最新系统性综述
为填补AI在科学研究应用缺乏全面综述的空白,提出AI4Research调查。其主流流程和分类分五个关键领域,各领域细分任务,凸显AI在研究中多样角色,还介绍多学科应用。
一份命中率 80% 的 AI 预测复盘|拾象年度预测
拾象团队复盘 2025 年 20 个 AI 关键预测,命中率达 80%。涵盖行业格局、技术路径等多方面,如微软投资 Anthropic改变格局、Google 逆转颓势等,也指出对部分方面过于乐观,还展望 2026 年 AI 领域。
百度想明白了:旧供给到达极限了
当下企业应用AI时,Token成本高、推理效率低问题凸显。百度Create大会释放旧供给达极限信号,推出新全栈AI云,含Agent Infra和AI Infra两层架构,多个场景应用初显成效。
所有环节都上最强模型,这可能是做 AI 智能体最贵的错误
开源项目 AgentOpt 指出,很多团队做 AI 智能体默认把最强模型塞进各环节,既贵效果也未必好。真正决定智能体效果和成本的是将合适模型放合适位置,智能体需要能找最优解的模型优化器。
AI的记忆问题解决了!最强记忆基准99%的准确率
Supermemory团队构建的实验性AI智能体流程,在LongMemEval基准测试中达近99%准确率。其技术摆脱传统限制,以新方式处理信息。ASMR创新数据摄取和检索管道,有两种回答流程,团队计划开源代码。
蓝湖悄咪咪在海外做了个 AI 设计产品,4 个月拿下 500w ARR
特工宇宙团队试用多款AI界面生成工具,发现多数距真实开发落地有差距。4月注意到Readdy.ai,操作简单、界面精致。其开发团队是蓝湖,上线4个月ARR达500万美元,解决用户真实问题。
当大模型陷入幻觉循环,如何用工程化给它“立规矩”?
普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。
星巴克与微软合作,在35个门店用Azure OpenAI 提升咖啡师效率
CNBC消息,星巴克本月将在35个门店推出由微软Azure OpenAI平台打造的AI助手Green Dot Assist,助咖啡师提效。虽AI会有‘幻觉’答案,但有验证引擎确保信息准确,星巴克还有更大应用计划。