「能力提升」共找到 5142 篇相关文章
Gemini Flash/Lite 更新:更聪明、更快、更省钱
Gemini 2.5 Flash 和 2.5 Flash-Lite 更新,可在 Google AI Studio 和 Vertex AI 上使用。相比稳定型号,预览型号质量和速度提升,效率更高,分别减少一定比例输出令牌。两版本各有优势,如 Flash-Lite 指令遵循等能力提升,Flash 工具使用性能更好。
DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2
昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。
刚刚!北大校友Lilian Weng最新博客来了:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。
ASO是什么意思?ASO目标与工作内容,ASO常见误区(基础篇)
ASO(应用商店优化)的精髓在于通过对产品特性的分析与用户群体标签的判断,挑选相关度高的关键词,提升App的覆盖、曝光、转化,从而获取更多用户。它不仅包括关键词搜索排名优化,还涉及榜单排名、转化率、推荐位等优化,提升App在应用商店的自然下载量。
腾讯入局具身智能,宇树首批用上“大脑”
腾讯在WAIC 2025推出具身智能Tarios平台,它模块化提供能力,集成腾讯软件能力。腾讯重申“三不原则”,与众多厂商合作。该平台核心含模型算法与云服务,能为厂商补齐软件能力。
当 AI 写了几乎所有代码,软件工程会怎样?
文章探讨 AI 写大部分代码时软件工程的走向。最新模型让开发者有‘顿悟时刻’,如 Google 工程师用 Claude Code 一小时完成去年的工作。AI 编程能力在 11、12 月迎来拐点,专业知识贬值,软件工程师核心能力更重要,也带来诸多挑战。
3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM全栈协同优化
阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与可解释性。
豆包 Seed 2.0 来了:字节模型跨越鸿沟
春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。
Temperature Scaling可大幅提高Test-Time Scaling瓶颈!
大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。
Prompt、Skills、MCP:大模型上下文工程核心链路
文章聚焦大模型上下文工程,介绍了Prompt、Skills、MCP核心链路。Prompt是与模型沟通基础,但其有脆弱、难管等痛点,促使向上下文工程演进;Skills是能力单元,可显式化能力、动态组合;MCP解决能力集成问题,虽有争议但理念重要。