「小模型性能」共找到 8714 篇相关文章
百度“龙虾” 全家桶亮相,多款龙虾产品上新,家用小度虾也来了
3月17日百度AIDAY龙虾专场,百度“龙虾”全家桶亮相,多款产品上新。百度集团沈抖谈OpenClaw趋势,还推出桌面AI智能体DuMate、“家用小龙虾”等,多个Skills也发布,持续降低体验门槛。
刚刚,小云雀的短剧Agent上线了,背后是字节自己的Seedance 2.0。
字节的小云雀短剧Agent上线,以Seedance 2.0为底层模型。它能根据剧本或设定自动生成高质量短剧,提升了AI短剧创作效率,且不挑风格。文中还介绍了使用流程及剧本创作方法。
时隔9个月Meta全新模型Muse Spark发布:闭源,原生多模态,一发布就落后?
时隔9个月,Meta推出Muse家族首款大模型Muse Spark,原生多模态推理,但能力表现一般,编程领域落后于opus 4.6和GPT 5.4等。它有沉思模式,致力于成个人超级智能,技术亮点多,性能高效。
微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1
微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。
谷歌「最强图像模型」横扫一切!3毛钱P图打懵OpenAI,PS要不存在了
谷歌发布顶级图像模型Gemini 2.5 Flash Image,化身nano - banana在LMArena盲测夺冠。它有四大能力,价格低至每张图不到3毛钱,冲击传统P图工具,虽有小瑕疵但应用前景广。
首创双NPU架构一鸣惊人!联发科天玑9500重磅加码主动式AI体验
联发科天玑9500首创超性能+超能效双NPU架构,让AI始终在线,融入用户操作。其输出性能、上下文窗口等有显著提升,还解决了模型加载慢等问题,与多厂商合作推动端侧AI落地。
轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源
上海人工智能实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。
SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能体,更少计算,更强性能
在多模态大模型加持下,纯视觉GUI智能体成通用操作智能体重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。
记录下SGLang 开发,debug的几个技巧第二弹
作者BBuf继上次分享后,又带来SGLang开发、debug新技巧。包括开启多线程加载模型权重,介绍SGLang Serve模型短期和长期崩溃的调试方法,还提及逐层NVTX Profiling、查看固定batch_size下Decoding性能等技巧。
从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026
WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。