MiniCPM-V 4.6」共找到 2311 篇相关文章

推荐文章7

如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性

文章通过分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在大规模 AI 训练中的表现。介绍三类训练负载及新的 Checkpointing 负载,分析共享文件系统类别,给出比较视角,解读各负载测试结果并总结选型要点。

InfoQ
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
推荐文章8

自主Agent时代群雄逐鹿,紫东太初何以走出一条中国特色AGI之路?|甲子光年

2026年OpenClaw掀起全民AI热潮,AI进入自主Agent时代。中科紫东太初依托中科院自动化所,以自研紫东太初ScienceClaw从AI4S赛道切入,破行业痛点,走出中国特色AGI发展之路。

甲子光年
算法论文8

“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能

在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。

深度学习自然语言处理
新闻资讯8

硅谷热议:最快语音转文字模型

AI语音独角兽ElevenLabs发布Scribe v2 Realtime实时语音转文本模型,实现150毫秒超低延迟、93.5%高准确率,覆盖90多种语言,打破速度与精度不可兼得困境,此前该领域痛点多。

量子位
新闻资讯7

OpenAI 4 名王牌研究员“叛变”,Meta 上亿美元的签约奖金终于花出去了

近日,Meta 招募 4 名前 OpenAI 研究员加入超级智能实验室。招聘背景是其 Llama 4 Behemoth 模型有性能问题。Meta 还以高额奖金挖角,且不局限于 OpenAI,还投入巨资支持 AI 项目。

AI前线
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家AI MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、分类体系、架构、评估方法与前沿趋势,还提出4W分类法,剖析了发展挑战与未来方向。

PaperAgent
开源动态8

阿里开源 Vivid-VR!带来逼真连贯的视频修复

阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。

带你学AI
新闻资讯8

加入Meta近一年,亚历山大王回应:超级智能之前,AI终局未定

亚历山大·王加入Meta近一年后携Muse Spark模型回归,回应诸多争议。他指出Llama 4发展不符要求,Meta缺超级智能信仰。介绍了Meta超级智能实验室架构原则,还谈到算力分层、模型福利等内容。

AIGC开放社区
新闻资讯7

Cursor 慌了:当 AI 不再需要代码编辑器

Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。

宝玉AI