性能影响」共找到 2563 篇相关文章

新闻资讯7

Meta 143亿挖角后首个作品来了:Alexandr Wang 推出闭源模型,杨立坤点赞

沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,Meta还披露技术实现细节。不过闭源引争议,且模型在长时程智能体等方面有短板。

AI前线
产品应用8

一夜暴涨至2100亿!开源新王MiniMax M2.5,革了Opus 4.6的命

新智元报道,国产AI春节档,MiniMax M2.5昨夜登场,今日市值涨至2108亿港元。其编码性能逼平Claude Opus 4.6,价格仅为1/20,适配开发者工具,在办公、深度研究等场景表现出色,基于Agent RL技术体系。

新智元
算法论文8

语义分割别无脑用Argmax!港中文新算法:三行代码,推理速度提升10倍

香港中文大学提出全新算法框架RankSEG提升语义分割性能。传统方法用threshold或argmax生成掩码并非最优,RankSEG无需重训模型,加三行代码就能提高分割指标,还开源了工具包,其改进版RankSEG - RMA推理速度大幅提升。

新智元
算法论文8

大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。

AINLPer
新闻资讯8

刚刚,AMD、OpenAI联合发布超强AI芯片,推理提升35倍

今天凌晨,AMD举办2025全球AI发展大会,与OpenAI联合发布Instinct MI400、Instinct MI350系列超强AI芯片。MI350推理性能提升35倍,MI400内存配置大幅提升。AMD还开源ROCm7平台,7大AI平台与其合作。

AIGC开放社区
开源动态7

WhisperLiveKit:本地同步实时语音转文字

实时语音转文字难题待解,现有方案各有缺陷。WhisperLiveKit项目用前沿同步语音技术解决问题,支持多语言同步翻译、实时说话人识别等,还介绍了安装、部署方式,不过效果受语言和模型等因素影响

AI工程化
算法论文8

Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16

Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。

AI寒武纪
新闻资讯7

GPT-5最大市场在印度?Altman最新访谈:可以聊婚姻家庭,但回答不了GPT-5为何不及预期

2025年8月8日OpenAI发布GPT - 5引发热议。虽受部分用户质疑,如反应慢、回答不准确等,但企业级市场反馈良好。OpenAI CEO Sam Altman在访谈中谈其特性、应用等,还探讨AI对各领域影响及社会问题。

AI前线
新闻资讯8

“连我也要被GPT-5踹了!”Altman再发暴论:写款软件就花7毛钱,大批高级程序员岗也说没就没

OpenAI 首席执行官 Sam Altman 在播客和会议上谈 GPT - 5,称其“几乎所有方面比人类聪明”,还预言 AI 对就业、医疗等领域影响大,也指出 AI 有欺诈等风险,强调其发展不确定性。

InfoQ
算法论文7

Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent