实验闭环验证」共找到 2171 篇相关文章

开源动态8

AI 真能看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为全模态智能发展提供指引。

机器之心
开源动态8

Mini-SGLang,30万行代码浓缩为5000行,大模型推理高性能教学与研究模版

SGLang发布Mini-SGLang,将30万行代码缩至5000行,保留核心特性,为大模型推理提供高性能教学与研究模版,解决教育门槛高和科研原型开发难的痛点,还经测试验证了性能。

AIGC开放社区
产品应用8

Hybrid Model Support:阿里云 Tair 联合 SGLang对 Mamba-Transformer 等混合架构模型的支持方案

文章介绍阿里云 Tair KVCache 团队与SGLang社区在推理框架上支持混合架构模型的工程化实践。分析混合架构崛起原因、面临挑战,阐述内存管理、关键技术优化方案,验证性能,并指出未来演进方向。

阿里云开发者
新闻资讯7

OpenAI这招太狠!AI从「躲猫猫」到「自爆黑料」,主打一个坦白

随着AI进入高风险场景,透明、安全变得重要。OpenAI提出「忏悔机制」,让模型回答后产出自我坦白报告,不影响主回答评分,只考察诚实,能提升不良行为可见性,目前仍处概念验证阶段。

新智元
产品应用8

无问芯穹首曝智能体服务平台,以基础设施加速企业级「智能体自由」

12月16日,无问芯穹在智能体生态论坛发布智能体服务平台。该平台为企业提供全链路陪伴式落地服务,解决生产级智能体落地和规模化的难题,助力企业实现智能体的高效商业化落地与可持续运营。

机器之心
推荐文章8

DeepSeek V3到V3.2的进化之路,一文看全

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。

机器之心
产品应用8

MV导演诞生!上海巨人网络用让AI听懂音乐并掌镜拍摄MV

上海巨人网络AI实验室提出YingVideo - MV框架,结合音乐语义分析、镜头规划与视频生成模型,解决传统音频驱动视频生成难题。它分两步生成视频,以MV导演模块统筹,还解决长视频连贯性等问题,性能优于同类模型。

AIGC开放社区
算法论文8

Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16

Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。

AI寒武纪
新闻资讯7

中国机器人产业生态营在首钢园开营,构建产业协同新范式

10月30日,中国机器人产业生态营在首钢园开营,由首程控股发起。其整合多方资源构建闭环式创新生态,旗下基金已投资多家企业。生态营学员多元,罗振宇进行AI夜话分享,后续还有专家授课。

首钢园
推荐文章7

后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题

文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。

AI科技大本营