「策略评估」共找到 1560 篇相关文章
面向长时语音与声音克隆的全模态开源万能聊天机器人MGM-Omni
文章介绍了全模态开源聊天机器人MGM - Omni,它基于MiniGemini,支持多模态输入输出,具备长语音理解、生成、流式生成、零样本语音克隆等特性,还给出安装、使用方法,展示评估结果。
快手提出强化学习创新框架RLEP,突破大模型推理瓶颈
OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。
如何用 AI 做营销:问题不是如何提效,而是底层打法变了
Olivia Borsje 认为 AI 重构营销行业,从工作边界、内容产出和策略方面带来变化。她总结的「AI Playbook」梳理营销 10 个核心问题,对比传统与新做法,还给出各环节实用建议。
刚刚,Anthropic官方Cluade 5使用指南发布
Anthropic发布Claude 5的Context Engineering官方指南,指出为Claude Opus 5和Claude Fable 5删掉Claude Code超80%的system prompt,在编码评估上无明显损失。还揭示6组范式反转及四类上下文载体新分工。
刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5
OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。
独家丨数千万天使轮融资,中科院背景团队「熵旋芯智」押注存内概率计算
AI 科技评论独家消息,熵旋芯智获数千万元天使轮融资,由英诺天使基金领投。该公司是国内唯一基于 MRAM 构建存内概率计算平台的企业,采用全栈软硬协同策略,有望大幅提升能效比,计划 2027 年初交付芯片。
本地运行、支持视觉与工具调用:Meta 开源智能体模型
Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。
Seedance 2.0之后,又一中国视频模型SkyReels-V4登上全球第二
昆仑天工发布SkyReels V4视频大模型,在Artificial Analysis Arena基准测试中排全球第二。它支持多模态输入、音视频同步生成等,采用独特架构与技术,经多阶段训练,有全新评估基准,表现出色。
arXiv开始拒收综述论文了?「论文DDoS」这事,这篇NeurIPS论文早有讨论
近日,arXiv宣布拒收未通过同行评审的综述和立场性文章,危机源于生成式AI与大模型。上海交大团队中稿NeurIPS的论文,精准预见此危机,提出“综述论文DDoS攻击”概念,还给出应对策略。