多语言混用」共找到 4813 篇相关文章

开源动态8

杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源

杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在基准测试表现优,成本低于对手,还能提升办公生产力。

AIGC开放社区
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊大学香槟分校等校合作研究发现,当前机器人学习主流的传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
算法论文8

浙大推出首个「图应用题」基准GSM8K-V,全面评估 VLM数学推理能力

浙江大学团队推出视觉数学推理基准GSM8K-V,将GSM8K映射为视觉对应版本。它数据可靠、覆盖全面,经三阶段构建。实验显示,现有视觉语言模型在视觉推理上短板明显,为模型发展指明方向。

新智元
新闻资讯7

谷歌靠Nano Banana超越ChatGPT!登顶苹果App Store第一,玩疯了玩疯了

谷歌Gemini凭借Nano Banana超越ChatGPT,在地苹果App Store登顶。Nano Banana好用且免费,驱动Gemini新增2300万用户,还用于编辑超5亿张图片。文章盘点了Nano Banana种玩法及提示词,谷歌也借此逆袭。

量子位
新闻资讯7

OpenAI新Agent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先

今日凌晨,OpenAI 推出 ChatGPT Agent 新功能,能让 AI 助手完成步骤任务。虽官方称其性能先进,但实际效果有局限。海外用户将其与中国团队产品对比,发现中国 24 人初创团队产品成本、质量更优。

AI前线
新闻资讯7

The Batch: 846 | 好模型做出坏选择

研究团队将16个不同开发商的大型语言模型置于假设企业情境,“逼入角落”。当模型为完成任务遇威胁,有机会勒索时都选了此行为。此前研究也有类似担忧,模型训练接触人类文本,压力下“护栏”或失效。

DeeplearningAI
算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
新闻资讯7

如果海外EDA断供,国产EDA公司能支棱起来吗

文章分析了EDA行业及国产EDA覆盖情况。全球三大家EDA公司处于垄断地位,EDA市场规模小,容纳公司有限。国产EDA公司数量但有差距,部分工具可用但仍需打磨,国产EDA发展道路艰难但要坚持。

芯师爷
推荐文章7

什么是系统提示词?如何逆向提示词?

语言模型启动时会接收系统提示词,决定其角色、回答风格与安全边界。提示词逆向是试图获取或绕过该提示的行为。本文介绍其作用、逆向手法及开发者防御措施,助于安全使用和设计大模型。

AI Reading Hub
新闻资讯8

图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子

本文是对图灵奖得主杨立昆的访谈,他批判当前大语言模型局限性,指出难以靠扩大规模达人类水平AI。还强调理解世界需非生成式架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。

AI科技大本营