成本性能平衡」共找到 3307 篇相关文章

算法论文8

西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026

AI 视频生成目前存在长视频稳定性问题,西湖大学张驰团队提出 《Free-Lunch Long Video Generation via Layer-Adaptive O.O.D Correction》。研究表明 FreeLOC 方法能提升长视频生成质量,且具跨模型通用性,还揭示了问题机制,降低算力成本

AI科技评论
算法论文8

静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代

文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。

深度学习自然语言处理
新闻资讯7

Sora关停背后:为啥它没跑成“视频版ChatGPT”?

OpenAI Sora 宣布关停,评论区评价两极分化。其未成为“视频版 ChatGPT”,主要因踩中生成式 AI 最难的三件事:使用频率、成本结构和产品形态。关停或与 OpenAI 筹备 IPO 有关,未来 Sora 团队将推进世界模拟研究。

AI前线
8

小米双模型正式开源!MiMo-V2.5-Pro无中断肝出“macOS”:54个应用全开、浏览器真能冲浪

小米MiMo-V2.5系列模型正式开源,权重全量开放。该系列含四大模型,综合实力对标国际顶尖水准。MiMo-V2.5 Pro能力出色,如4小时无中断完成“macOS”系统,且Token效率高省成本。小米还推出开发者扶持计划。

量子位
产品应用7

实测吓一跳,gpt-5.6居然比deepseek flash还便宜

上周GPT-5.6 luna打2折,次日梁圣的v4flash正式版发布。经实测,把GPT薅到极致比DeepSeek便宜,还整出无限活力流玩法。Luna max智力分值超Sol high,虽耗时久但成本低。

探索AGI
产品应用8

突发,打工版Claude 5来了!人人都能用

Anthropic推出Claude Sonnet 5,代号Fennec。它性能直逼旗舰Opus 4.8,即日起成所有Free和Pro用户默认模型,能自主规划等。价格有促销,虽tokenizer或使花销增加,但仍比Opus划算,防护能力也强。

新智元
产品应用8

实测腾讯云 AndonQ:号称比肩原厂技术专家的 “领域虾”,到底有多能打?

文章实测腾讯云 AndonQ,它号称全球首款 ITSM“领域虾”,可适配主流“虾”类工具,集成至 IM Bot。测评显示其成本低、上手轻量,在架构选型、故障排查等场景表现出色,将 ITSM 体系浓缩到对话框。

AI前线
产品应用7

硅谷深夜不写一行代码!放羊大叔Ralph引爆奇点,睡一觉AI全跑通

放羊大叔Ralph Loop掀起生产力革命,无需手写代码,AI就能搞定软件开发。它把任务拆到最小颗粒度解决普通AI崩溃痛点。还介绍融入工作流的方法、运行方式及成本,强调掌握此技能的重要性。

新智元
开源动态8

12ms!一个仅8M的语音停顿检测模型

语音助手准确判断用户是否说完是挑战,Smart Turn将决策过程缩至12毫秒。其v3.1版有改进,新增数据集提升英语识别准确率,推出未量化版本推理更快,8MB模型性能优,已在HuggingFace开源。

AI工程化
算法论文8

调整训练数据出场顺序,大模型就能变聪明!无需扩大模型/数据规模

微软亚洲研究院提出全新文本数据组织范式DELT,通过引入数据排序策略,充分挖掘训练数据潜力,优化训练数据的组织方式,在不同模型尺寸与规模下都达到了良好性能,且不用增加数据量或扩大模型规模。

量子位