「模型开源」共找到 8795 篇相关文章
开源「活人感写作.skill」,只为帮你写出没有AI味的文字。
作者开源活人感写作.skill,旨在帮大家写出无AI味文字。它适配多种模型和产品,鼓励用真实经历创作,除了去除辞章端AI口癖,还会激发思想、验证事实,让大家保留自我。
SGLang × RoleBasedGroup(RBG):打通大模型推理PD分离架构规模化落地的“最后一公里”
PD分离架构对大模型推理部署意义重大,SGLang支持该架构且性能佳。但从测试到生产落地难,存在部署、资源、可靠性等问题。SGLang开源RBG项目,结合二者为PD分离架构生产化落地提供方案。
Google 把翻译能力彻底开源了!TranslateGemma:550种语言通吃,还能直接看图翻译!
Google将多年积累的翻译能力灌进开源大模型TranslateGemma,它基于Gemma 3,专为翻译任务调优,有3个规模版本,覆盖550种语言,能直接看图翻译,亮点颇多。
超越ZIP的无损压缩来了!华盛顿大学让大模型成为无损文本压缩器
华盛顿大学SyFI实验室提出LLMc,利用大型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。
里程碑!Artificial Analysis:Mac能跑的两款开源模型正式追上GPT-5
据Artificial Analysis报告,32B以下开源模型比肩GPT - 5。Qwen3.5 27B、Gemma 4 31B分别与GPT - 5中杯、小杯智能水平相当,虽知识全面性落后,但智能体表现和批判性推理进步大,硬件门槛低。
模型一个没换,正确率翻了近三倍,这个项目有点东西啊!
GitHub开源项目AutoResearch用同一模型答题,其EvoMap蜂群模式使正确率近三倍于单Agent和常见Sub - Agent模式。它是多Agent评审系统,靠蜂群机制让AI自动科研,还有诸多防幻觉等特点,能用于多场景优化。
6小时复刻AI IMO金牌成果,蚂蚁多智能体新进展已开源
2025年IMO赛场,顶尖大模型起初表现不佳后有突破。蚂蚁AWorld项目团队6小时复现并开源DeepMind解题结果,给出可一键运行系统。AWorld证明多智能体协同优势,还介绍复现思路、核心优势及体验方式。
字节开源GUI Agent登顶GitHub热榜,豆包手机核心技术突破26k Star
字节开源的豆包手机核心支撑GUI Agent模型UI - TARS登顶GitHub热榜,突破26k Star。它是多模态AI智能体,纯视觉驱动,部署简单,历经多轮迭代,成为热门开源多模态Agent。
让AI看懂科研图表:深势科技开源150万高质量科研图文数据集
深势科技开源OmniScience数据集,含150万个高质量图文对。它利用先进工具攻克图文提取难题,经严格筛选成型,涵盖多学科。还设计重写流水线提升图文语义契合度,基于此训练的模型表现优异。
TEN VAD 开源:低延迟、高准确率,提升「语音 Agent」上限就靠它!
TEN-VAD是专为实时流式语音场景优化的开源模型,能解决语音交互中常见问题。它轻量级、跨平台、高性能、低延迟,获大佬背书,在多场景是必选组件,是语音交互里易被忽略却难替代的一环。