「频率-空间融合」共找到 1026 篇相关文章
798 × BOE|「找到一个好屏友」科技创新展落地798·751园区
8月15日,2025你好BOE「找到一个好屏友」科技创新展在798·751园区启幕,由京东方与七九八文科联办。活动有AI加持,打造新场景,还设六大展区成互动空间,持续至8月24日。
上海交大团队发布首篇「搜索智能体」综述!四个维度深度剖析搜索智能体
上海交大团队发布首篇「搜索智能体」综述,从如何搜索、优化、应用、评估四个维度剖析。随着LLM兴起,搜索从传统模式向搜索智能体转变,虽有潜力但缺统一研究视角与评估框架,该综述提供了路线图。
1句话高质量生成游戏3D动作,北大新方法刷新动画制作SOTA
北京大学提出ReMoMask:基于检索增强生成的Text - to - Motion框架,集成三项关键创新。在标准基准测试上,相比RAG - T2M,在HumanML3D和KIT - ML上FID分数分别提升3.88%和10.97%。
0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈
大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。
小目标检测难点分析和解决策略
文章基于24年综述论文,分析小目标检测难点,如特征不足、难区分背景等,还给出主流改进方法,涉及数据增强、特征提取、特征融合、损失函数、训练策略等方面,介绍多种算法及效果。
打破长视频理解瓶颈:HoPE混合位置编码提升VLM长度泛化能力
如今视觉语言模型在长上下文任务表现不佳,CMU和小红书团队深入研究,首次提出多模态RoPE扩展策略理论评估框架,指出现有泛化能力不足原因,提出HoPE大幅提升VLM长度泛化能力。
3D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32%
中科院自动化所提出BridgeVLA模型,将3D输入投影为2D图像并利用2D热图进行动作预测。它训练分两阶段,在多仿真基准和真机实验表现卓越,仅3条轨迹基础任务成功率达96.8%,真机性能提升32%。
AI大模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭
在 AICon 全球人工智能开发与应用大会·上海站(2025)现场,网易有道孟旭以有道 AI 答疑笔为例,分享智能学习硬件变革逻辑,指出其进化是用户需求、硬件创新与 AI 技术螺旋推进,还探讨大模型应用及未来方向。
技术更新 or 组织重塑,企业如何用好“数据智能”?
InfoQ《极客有约》X AICon 直播栏目邀专家探讨企业数据智能应用。谈及构建数据集、优化检索效率等问题,还分析数据准备挑战、DeepResearch 优势,指出数据智能落地面临组织与技术层面的挑战。
深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景
大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。