「ERNIE-4.5-0.3B」共找到 4836 篇相关文章
Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限
Prime Intellect公开大规模AI自主科研实验,18大顶尖模型断网8天挑战nanoGPT优化器速通,Fable 5追平人类82%的水平,AI开始独立完成科研闭环,但目前尚无模型有全新方法。
多模态卷王阶跃星辰Step 3登场,推理效率可达DeepSeek-R1 300%
新一代多模态推理基模Step 3登场,它采用原创MFA架构,具“多开好省”亮点,推理效率高、性价比优。7月31日将开源,能适配各芯片,还发起“模芯生态创新联盟”推动应用落地。
0.01%参数定生死!苹果揭秘LLM「超级权重」,删掉就会胡说八道
苹果研究人员发现大模型中极少量的「超级权重」,即便占比仅0.01%,对模型能力影响巨大。这一发现为大模型「科学瘦身」提供思路,还提出定位方法,助力模型量化和未来研究。
Qwen3-Next全新架构,32K场景MTP吞吐提升10倍
随着模型大小和上下文长度增加,为应对成本和部署挑战,Qwen3 - Next有突破性架构创新,解决上下文长度和总参数缩放问题。它采用混合注意力、超稀疏MoE等,MTP机制让其长上下文推理吞吐量比前身高10倍以上。
开源2天斩获3K标星!开源TTS新星Chatterbox盲测击败ElevenLabs!
文本转语音(TTS)技术发展快,但达顶尖水平仍有挑战。开源TTS新星Chatterbox,开源2天冲上GitHub热榜,星标超3K。它功能亮点多,安装简单,适用于多种场景,性能超ElevenLabs。
苏姿丰出手!Oracle下单5万颗AMD芯片,英伟达王座撼动
Oracle宣布2026年第三季度起在云基础设施部署5万颗AMD Instinct™ MI450系列GPU构建AI超级集群并持续扩容。AMD Instinct MI450系列GPU亮点多,此次合作是其与Oracle合作的深化,也被视为AMD挑战英伟达的关键突破。
Seedance 2.5 抽卡老废片?专业团队的 4 层控制法
Seedance 2.5上线后,单条画质好但成片易散架,废片率高。文章将官方提示词指南和一线分镜写法整合成四层控制框架,还给出30秒短剧分镜示例,助你定位问题、提高抽卡效率。
GPT-4o连验证码都解不了??SOTA模型成功率仅40%
MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。
英伟达开源9B参数小模型,比Qwen3快6倍
英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。
商汤医疗再获超5亿元融资,估值突破10亿美元
商汤医疗年初完成超5亿战略融资,估值破10亿美元。其走医疗世界模型路线,构建独特产品迭代体系,与超500家医院、多家药企及器械企业合作,推进全球化布局。