「国产开源模型」共找到 8989 篇相关文章
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
清华大学、中国人民大学等联合研发的 AgentCPM-Explore 开源,基于 4B 参数在深度探索任务上表现出色,打破参数壁垒,开源全流程基建,还探索出提升小模型性能的方法。
宇树科技开源UnifoLM-WMA-0机器人模型,离通用机器人又进一步
宇树科技开源UnifoLM-WMA-0模型,用神经物理网络让机器人理解力学规律。它支持两种模式,融合多模态信息,架构精妙。经测试性能强,已真机部署。开源降低门槛,有望推动行业发展。
开源开发者须知:欧盟《人工智能法案》对通用人工智能模型的最新要求
欧盟《人工智能法》2024 年 8 月 1 日生效,2025 年 8 月 2 日起对 GPAI 模型提供者提出合规要求,科研或开源模型有豁免。本指南助开发者判断合规情况,介绍关键定义、义务及豁免条款,还提供交互式应用。
DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式
DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。
AI开源狂飙,OpenAI们慌了!GenAI大洗牌,2025趋势深度解读
2025年,ChatGPT仍领跑,但DeepSeek、Qwen等开源模型加速追赶。独立机构报告总结六大趋势,涵盖技术突破与市场格局演变,如推理模型实用化、MoE架构普及等,开源势力挑战闭源巨头。
没想到,最Open的开源新模型,来自小红书
向来低调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。
3.6K Star!OpenCode 团队开源宝贝,模型价格、能力、规格一网打尽!
开发AI应用时,模型选择成难题,信息碎片化、不透明让人头疼。OpenCode团队开发的开源项目Models.dev,整合主流模型关键信息,可一站式查询、精确估算成本、对比能力,还提供公开API,社区驱动持续更新。
吴恩达来信:开放模型,开放执行框架,开放安全
吴恩达团队用闭源模型做安全审查遇阻,后改用 OpenWorker 框架结合开源权重模型 Kimi K3 和 GLM 5.2 取得进展。他认为开放模型和执行框架能带来更安全系统,开源权重模型舆论战虽胜,但立法层面未胜。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
纯血国产!4B模型越级打怪,杀入万亿赛道
9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。