「K2.5模型」共找到 9186 篇相关文章
视觉语言模型“扫地僧”:360低调开源FG-CLIP2登顶29项全球基准测试 | 甲子光年
两周前,360人工智能研究院低调开源FG - CLIP2,它在29个公开基准测试中超越Google和Meta的模型。该模型实现局部细粒度识别和原生双语对齐,为AI视觉理解设新基准,已服务开发者并在多领域落地。
传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分可不行
近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5长任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。
一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一
文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。
Claude Sonnet 4.5来了!能连续编程30多小时、1.1万行代码
十一假期前,DeepSeek 开源新模型 V3.2 - Exp,深夜 Anthropic 发布 Claude Sonnet 4.5,自称世界最好编码模型,自主编码时长超 30 小时,还带来系列产品升级,在多方面表现优异。
Altman 秀新模型“翻车”,谷歌补刀躺赢!OpenAI 前员工爆肝3天,编程再赢老东家模型!
近期 OpenAI 多款未发布新模型登场,一款疑是“伪装的 GPT - 5”,一款编程赛获第二。宣称在 IMO 获金牌的模型遭质疑,谷歌 DeepMind 同获金牌评价更好。OpenAI 前员工编程赛赢老东家模型。
大模型桌游试玩员来了:用五大画像模拟「千人千面」,评分精准度超越GPT-5.1
盛大东京研究院等团队提出MeepleLM,首个能模拟玩家视角给出建设性批评的虚拟试玩模型。它构建专属数据集,引入MDA理论,提炼五种玩家画像。实验显示其评分精准度超GPT - 5.1等通用模型。
最强3B「小钢炮」,代码数据全公开!推理随意开关,128k超长上下文
Hugging Face推出30亿参数模型SmolLM3,支持128k长上下文,训练等全链路开放。它在架构、数据混合策略等多方面优化,性能超Llama3.2 - 3B等,还公开双模式指令模型构建方案。
将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式
快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。
一年前让英伟达蒸发6000亿,一年后被老黄搬上PPT
北京时间1月6日,黄仁勋在CES 2026上展示Kimi K2、DeepSeek V3.2、Qwen等中国模型。此前英伟达因谷歌、Meta等对手的冲击市值蒸发。老黄花200亿美元挖人,用中国开源模型反击,构建开放生态。
GitHub 23.6k star 的 BMAD Method:如何把大模型系统提示词,变成一支“可复制的 AI 开发团队”?
BMAD Method是开源的AI驱动敏捷开发方法论与工具集,基于BMAD Core框架,有19个专业AI角色和50+条工作流,获23.6k颗GitHub Star。它解决了大模型使用痛点,将AI开发工程化,可在多工具复用。