高动态控制」共找到 2593 篇相关文章

推荐文章7

如何让AI“看懂”网页?拆解 Browser-Use 的三大核心技术模块

传统Browser - Use难应对界面变化,大模型驱动下正迈向智能化。文章拆解其三大核心技术模块,介绍历史发展、核心功能,分析源码各模块,指出创新点与不足,还提及业界更好解决方案。

阿里云开发者
开源动态7

蚂蚁开源MedResearcher-R1医学知识图谱+多跳推理

医学领域需处理复杂关系,现有医学AI系统缺乏对罕见实体和复杂关系的推理能力。MedResearcher - R1通过专门图谱和检索工具,结合两阶段训练范式解决问题,在医学基准测试取得新成果。

CourseAI
开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。

Hugging Face
算法论文8

Meta提出StepWiser,让模型学会“反思”自己的推理过程

Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。

深度学习自然语言处理
新闻资讯7

OpenAI与Anthropic罕见合作:竞争对手联手测试AI安全

OpenAI和Anthropic完成联合评估,用内部工具测对方模型并公开结果。测试覆盖指令层级、越狱等四大领域,还发现不少细节和道德困境情况。此次合作意义重大,为行业树立安全合作先例。

AGI Hunt
新闻资讯7

图解GPT-OSS:架构、消息格式与推理机制等

OpenAI发布首个开源大模型GPT-OSS,虽性能无惊喜,但设计思路有意思。其架构是经典延续,消息格式有巧思,支持三档推理模式,分词器有小进步,这些设计在实际应用和理论上有一定价值。

AI工程化
算法论文8

妙笔生维:线稿驱动的三维场景视频自由编辑

研究人员提出基于线稿的三维场景视频编辑方法Sketch3DVE,相关论文发表于SIGGRAPH 2025。它能让用户基于线稿重塑三维场景视频,解决了现有方法个性化不足、真实感差等问题,支持单目图像三维视频合成和二次编辑。

机器之心
新闻资讯8

AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河

在 AICon 大会上,IDEA 研究院张磊剖析多模态智能体发展难题,提出从“半结构化”场景切入的落地路径,分享工业界研究与产品平衡见解,还为年轻人在 AI 浪潮中发展给出建议。

AI前线
产品应用8

谷歌DeepMind深夜放核弹:世界模型Genie 3登场,重新定义“生成式AI”

谷歌DeepMind推出第三代通用世界模型Genie 3,能生成多样化交互式环境,可实时导航。它较前代有诸多突破,有模拟物理特性等核心能力,能赋能具身智能体研究,但也存在行动空间有限等局限。

AI寒武纪
开源动态8

多模态卷王阶跃星辰Step 3登场,推理效率可达DeepSeek-R1 300%

新一代多模态推理基模Step 3登场,它采用原创MFA架构,具“多开好省”亮点,推理效率、性价比优。7月31日将开源,能适配各芯片,还发起“模芯生态创新联盟”推动应用落地。

新智元