单目语义场景补全」共找到 2392 篇相关文章

开源动态8

蚂蚁C2LLM:基于注意力池化的代码检索新范式

在Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,在MTEB - Code榜表现出色,还得益于优质训练流程,成果已回馈社区。

PaperAgent
开源动态7

AMD跑GLM 5.2,成本只要英伟达一半

推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,节点吞吐达2626 tok/s,流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。

量子位
推荐文章7

图解Vllm V1系列5:调度器策略(Scheduler)

本文是图解Vllm V1系列5,聚焦调度器策略。先回顾vllm v1整体运作流程,接着阐述调度 - 推理的整体流程,包括将请求添加进Scheduler、Scheduler步调度策略等,还对比了不同场景下的函数及调度逻辑。

GiantPandaLLM
产品应用8

国内首张防爆资质、全球首个加油大脑方案,他们凭什么拿下两个「第一」

今年是具身智能商业化落地关键年,深圳若愚科技携自研「若愚九天机器人大脑」及特种防爆机器人「若愚揽月 01」亮相。其拿下国内首张防爆资质,推出全球首个加油大脑方案,在多场景验证能力,技术有多项创新。

机器之心
新闻资讯7

机器人竞技赛事刷屏,宇树们抢的不止是流量

今年人形机器人赛事不断,宇树科技直播机器人格斗赛,众擎、加速进化也有相关赛事。企业借赛事抢流量,展示技术实力吸引开发者,打造机器人平台。但赛事娱乐性强,商业化难,企业需找刚需场景落地技术。

芯师爷
算法论文7

一张俯视图,竟然能生成完整3D小镇?

获取高质量3D场景成本高、耗时长,现有3D生成模型扩展到完整场景生成时问题多。加州大学提出无需训练的3DTown框架,能从张俯视图合成真实连贯3D场景,虽有挑战但表现优于基线方法。

带你学AI
产品应用7

Claude Code 推出 Monitor 功能,帮你随时盯梢

Claude Code 在 v2.1.98 版本推出 Monitor 功能,可让 Agent 后台挂监控脚本,解决轮询痛点。它能覆盖日志监控等多场景,与 /loop、/schedule 功能有别,使用有注意事项,反映 Anthropic 让其成工程系统的方向。

AGI Hunt
开源动态8

腾讯重磅开源!端到端视频音效生成模型HunyuanVideo-Foley

腾讯混元正式开源端到端视频音效生成模型 HunyuanVideo-Foley,适用于多场景。它采用新型框架结合 REPA 策略,有三大核心优势,能适配多种场景,抑制底噪,保证音频保真度。

带你学AI
产品应用7

“聊天干活”只需扫个码:微信配WorkBuddy,自家出品就是快

微信推出 ClawBot 插件,与腾讯自研 WorkBuddy 适配,接入门槛低。它像统一“任务入口”,可让用户在微信下达任务。适用于媒体记者信息预处理、深度研究、灵感沉淀等场景,使微信从“信息容器”变“任务容器”。

InfoQ
产品应用8

黄仁勋100万亿预言兑现!易鑫Voice Agent落地,汽车金融迎效率革命

2024年GPT - 4o问世后,Voice Agent创业公司涌现,但通用方案在金融等场景「水土不服」。易鑫深耕汽车金融,自研工业级Voice Agent系统,采用Model + Harness方法论,实战数据亮眼,还将向泛金融领域延伸。

新智元