「可灵 3.0」共找到 6114 篇相关文章
科学智能2.0的「最强大脑」!上智院复旦无限光年联合发布开放平台
WAIC 2025上,上海科学智能研究院、复旦大学、无限光年联合发布「星河启智科学智能开放平台」。它以六大核心能力打造科学智能生态、驱动科研范式变革,致力于实现「科学的AI次方」效应。
刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3
互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,在多基准测试中超越诸多开闭源模型。
南洋理工 | 推出开源版MetaQuery:OpenUni,1.1B参数媲美BLIP3-o-8B
南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数就达 8B 模型性能。它架构极简、参数高效且完全开源,还采用两阶段训练策略,虽有局限但为多模态模型研究助力。
多模态模型挑战北京杭州地铁图!o3成绩显著,但跟人类有差距
近年来,多模态大模型在多种场景取得进展,但能否‘看懂图’存疑。西湖大学等团队提出评测基准ReasonMap,评估模型在地铁图理解中的能力,发现主流模型有瓶颈,闭源模型虽优但仍逊于人类。
字节开源了一款多模态神器!BAGEL上线,超越Qwen2.5-VL,媲美SD3!
多模态AI发展进入新阶段,字节跳动开源通用多模态大模型BAGEL。它支持多模态输入输出与思维链推理,性能超Qwen2.5 - VL等,安装使用友好,有多种应用场景。
3.4K星Apple出品FastVLM:视觉TTFT效率提升85倍,凭啥这么牛!
文章指出VLM在实际生产应用中因高分辨率图像存在效率问题,介绍Apple出品的FastVLM解决方案,阐述其架构、训练过程,展示在多个基准测试的性能,凸显在高分辨率输入下提升效率的优势及实际应用价值。
斩获3K+ star,再见传统开发!这款开源AI后台开发框架让效率提升300%
ruoyi - ai是基于ruoyi - plus开发的开源AI平台,集成前沿模型,有聊天、绘画等全栈AI能力,具多模态交互和企业级部署支持,核心功能丰富,技术架构优,有实战成效,与同类有差异。
用GPT-6 Astra就能直接控制机器人?可具身真机没那么简单
本文讨论GPT-6 Astra接入机器人控制取得亮眼单项成绩,但真机测试暴露不安全不稳定问题,介绍穹彻智能发布的开源RoboRSI多智能体自进化框架,解决具身智能落地核心痛点,探讨大模型时代具身智能行业的发展方向
企业官网GEO优化:可直接复制JSON-LD+llms.txt模板(适配AI推荐)
文章提供企业官网GEO优化方案,含首页、FAQ页结构化代码及llms.txt模板,还有通用FAQ选题。介绍使用方法、上线校验步骤和生效判断标准,助企业适配AI推荐。
Stripe 发布基准测试:AI 智能体可开发集成方案,但校验环节存在短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。