「小目标注意力模块」共找到 994 篇相关文章
AI牛马实现“干中学”!上海AI Lab联合推出智能体自我进化新框架
上海人工智能实验室等研究者提出MUSE智能体框架,让智能体实现“干中学”。它围绕分层记忆模块,通过先做、再反思、然后进化,解决现有智能体痛点,实验表现出色,还展望了未来优化方向。
能自动把PDF转换为可填写表单的开源工具,实用可落地。
CommonForms是能自动将PDF转换为可填写表单的开源工具,通过检测文本框等自动添加交互字段。它基于YOLO11做目标检测,支持CLI和API使用,有多种功能特点,能高效处理转换。
为什么我用了那么多提示词模板甚至用了 AI 帮忙还是写不好提示词?
现在很多人觉得模型强大,提示词工程没必要,但复杂需求仍需它。作者以写雷军演讲提示词和YouTube字幕生成提示词为例,介绍迭代创作过程,指出写不好提示词根源是难评估差距和调整。
102.4 亿 AI 数字人市场下:华为云 × 今日人才如何打造能用且好用的数智员工?
当前多数企业将 AI 作辅助工具,先锋玩家则将其“超级能动性”用于“数智员工”。数智员工应用面临挑战,华为云与今日人才合作打造产品,如政务数智员工,还构建培育体系,推动其从辅助向协同升级。
手机“自动驾驶”时代来了,智谱还让手机拥有“云替身”
作者参加智谱AutoGLM新版本闭门会并试用,该版本亮点多,如成全球首个手机通用Agent,操作在云设备运行,全平台覆盖等。云手机Agent能力稳定高效,能处理多类任务,还可助老人等群体用手机。
DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率
ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。
适配鸿蒙操作系统!!腾讯游戏直播SDK基于Kuikly三端一码开发实践
随着鸿蒙Next发布,腾讯推进游戏电竞直播SDK鸿蒙适配。基于Kuikly框架实现业务代码100%跨三端、跨多App复用,节省超50%人力。介绍适配工作、目标、方案,还提及组件Kuikly化等内容。
OpenAI去年挖的坑填上了!奖励模型首现Scaling Law,1.8B给70B巨兽上了一课
全新奖励模型「POLAR」采用对比学习范式,摆脱对海量人工标注依赖,有强大Scaling潜力。它衡量训练与目标策略「距离」作奖励信号,用自动化合成数据预训练,小模型能超越大数十倍规模对手。
OpenAI 宣布启动“全国人工智能教育研究院”:美国K-12教育全面AI化
OpenAI宣布与美国教师联合会合作,启动‘全国人工智能教育研究院’,这是为期五年的计划,目标是为全美40万K12教育工作者提供AI培训和支持。OpenAI五年内投入1000万美元,计划在多地建中心。
MoCa:首个大规模双向多模态表征模型
为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它分两阶段,实验效果好,未来可拓展模态、提升多语言适应等。