「模型跑分」共找到 8174 篇相关文章
Qwen3.5实战教程:从0到1掌握本地部署与微调
阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。
刚刚,加入腾讯的姚顺雨发表首篇Paper~
腾讯混元与复旦联合发表论文《CL-bench》,姚顺雨署名并全面细致审阅反馈。CL-BENCH 首次单独考‘现学现卖’,有独特设计原则、四大题型,其评分杜绝‘差不多’,还让 10 个前沿模型‘翻车’。
深度体验TRAE SOLO 正式版,总结一点技巧(附完整可重现提示词和源码)
TRAE SOLO正式版面向国际版所有用户全量上线,模型能力提升且限免。它是响应式编码特工,适合复杂任务。有打通‘行动➔验证’闭环、SubAgent管理上下文等亮点,正式版还有多处升级,作者分享实战技巧。
这是我见过最全的免费 LLM API 指南,正规合法、开箱即用!
个人开发者在使用LLM API时面临成本高、资源杂乱、稳定性差等问题。Github上项目`free-llm-api-resources`整合全网正规免费资源,排除不合规服务,介绍主流模型、限制说明等,值得收藏。
全球第二易主,谷歌逆袭登顶!OpenAI 500亿股票池曝光,Ilya躺赚40亿
谷歌母公司成全球市值TOP 2,Gemini市场份额疯涨。被逼急的OpenAI甩出500亿美元员工股票池,Ilya或分40亿。谷歌有入口优势,AI竞赛进入拼入口阶段,OpenAI砸钱抢人赌未来。
解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南
给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
ACL首届博士论文奖公布,华人学者李曼玲获荣誉提名
自然语言处理顶会 ACL 公布首届计算语言学博士论文奖,获奖者是华盛顿大学的 Sewon Min,其论文聚焦大型语言模型数据使用。此外,还有三篇论文获提名,包括李曼玲等学者的成果。
OpenAI发布权威AI科研基准,扯下AI遮羞布:奥赛金牌≠一流科学家!
OpenAI在2025年12月16日发布FrontierScience基准,用超700道题从物理、化学、生物维度考验AI科研推理能力。评测分竞赛和研究赛道,初测显示GPT - 5.2领先,但前沿模型仍有诸多问题。
鹅厂员工都用AI Coding捅过多少篓子?
本文盘点AI Coding翻车现场及防坑指南,10位鹅厂同事分享用AI Coding捅过的篓子和防坑技巧,如选好模型、手动拆解任务、提前备份、限制危险操作等。