「AI小模型」共找到 13839 篇相关文章
告别盲目卷参数!科大讯飞1024亮出底牌:all in“更懂你”
在模型能力趋同当下,科大讯飞在1024开发者节提出让AI“更懂你”。展示多模态超拟人“小飞老师”和「百变声音复刻」功能,发布星火X1.5大模型,还推出多领域软硬件产品,赋能多行业。
英伟达发布并开源Alpamayo:自动驾驶终于开始讲道理了|甲子光年
北京时间今天凌晨,英伟达在CES现场发布Alpamayo系列开源AI模型、仿真工具及数据集,旨在推动推理型自动驾驶汽车开发。其核心模型Alpamayo 1可展示决策逻辑,此次发布是英伟达在该领域开放程度最高的尝试。
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次
Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。
三个关键词,2026谷歌 I/O大会全说透了
北京时间今天凌晨,谷歌 I/O 2026 落幕。皮查伊称聚焦模型、编程和智能体。模型上,Gemini 3.5 Flash 全量上线,性能超上一代;编程方面,Antigravity 2.0 用低成本造能跑 Doom 的系统;智能体层,Spark 和 Search Agents 让 AI 走出对话框。
DeepSeekV3.2技术报告还是老外看得细
ChatGPT三岁生日时,DeepSeek两款开源模型DeepSeek-V3.2和DeepSeek-V3.2-Speciale引发热议。它们在智能体评测中表现出色,缩小了开源与闭源模型差距,还降低了成本,给硅谷闭源AI公司带来压力。
2026 年做搜索就是做 Agent Memory
本文整理自Elastic全球副总裁肖涵演讲,讲述AI搜索发展历程,指出2026年做搜索基本是做智能体记忆。分析智能体记忆痛点、表征、遗忘等问题,介绍Jina AI相关模型,梳理记忆产品分类与工作流,给出行业观点与建议。
The Batch: 948 | GLM 5.1:面向长时任务的能力提升
Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。
英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛
本周末英伟达有两大动作。一是推出CUDA 13.1,这是CUDA平台诞生二十年来最大更新,引入CUDA Tile编程模型等。二是在Kaggle ARC Prize 2025竞赛中,团队用4B小模型变体夺冠,靠合成数据等策略。
Claude 通过率不到 4%,SaaS-Bench 撕碎了 Computer-Use 的「全自动办公」幻想
UniPat AI用SaaS - Bench测试,让Agent在真实工作环境中执行任务。结果显示,Claude Opus 4.7端到端完全通过分数仅3.8%,多数模型表现差,还暴露Agent四种致命缺陷,揭示其与真实工作能力有巨大鸿沟。