「分镜控制」共找到 1074 篇相关文章
能查信息≠循证AI:OpenEvidence爆火在前,中国医生的「信任死结」谁来解?
AI医疗市场增长快,但国内落地面临医生信任难题。医渡科技发布的医渡智循,通过全流程技术体系、多专科智能体协作等,解决AI信任问题,实现全场景布局,让AI回归循证。
不平衡数据下对比学习的理论分析:从训练动态到剪枝解决方案
本文第一作者为新泽西理工学院廖海旭。对比学习在类别不平衡数据下面临挑战,此前研究未考虑其影响。本文构建理论框架刻画训练动态,定量分析少数特征影响,提出剪枝算法增强少数特征学习,实验验证其有效性。
Karpathy:20年的编程生涯几周之内被颠覆,80%由AI来写,Claude和Codex跨过某种一致性门槛
OpenAI创始成员Andrej Karpathy分享用Claude编程心得,工作流从80%手动变为80%由AI完成,阐述AI编程优缺点、影响,还对行业未来提出疑问,认为2026年是充满能量的一年。
AAAI 2026结果公布,刷出88887高分!2.3万投稿录用率仅17.6%
AAAI 2026录用结果公布,投稿量达23,680篇创历史新高,录用率仅17.6%。多位研究员论文被录用,如北大顾怿洋、南洋理工加小俊等。同时,Reddit上对此次录用讨论热烈,有人质疑存在‘关系户’现象。
好上手又强大!5分钟上手Claude Code插件,保姆级教程
此为Claude Code插件保姆级教程,介绍环境选择、下载安装、登录账号等步骤,按场景讲解核心功能,还给出快捷键速查,对比插件版与命令行版优缺点,为新手和深度用户提供选择建议。
「一页纸」吃透产业链之:人形机器人,Figure链与特斯拉Optimus链
文章聚焦人形机器人,分析其产业处于量产落地拐点,2025 - 2026年是关键期。介绍产业链上中下游情况,指出面临的软硬件挑战,还提及市场规模、主要参与者,重点关注Figure与特斯拉Optimus产业链。
如何让AI“看懂”网页?拆解 Browser-Use 的三大核心技术模块
传统Browser - Use难应对界面变化,大模型驱动下正迈向智能化。文章拆解其三大核心技术模块,介绍历史发展、核心功能,分析源码各模块,指出创新点与不足,还提及业界更好解决方案。
社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!
阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。
不愧是中国机器人,乒乓打得太6了
清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还能连打106拍。
图解GPT-OSS:架构、消息格式与推理机制等
OpenAI发布首个开源大模型GPT-OSS,虽性能无惊喜,但设计思路有意思。其架构是经典延续,消息格式有巧思,支持三档推理模式,分词器有小进步,这些设计在实际应用和理论上有一定价值。