低资源语言」共找到 2343 篇相关文章

开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗、架构优,模型训练方法创新。

AIGC开放社区
推荐文章7

AI领域并无真正的新想法,只有新的数据集

作者Jack Morris认为AI虽进步明显,但范式转变级突破不多。大语言模型四次关键突破底层理论早已有之,新在于数据。改变数据比调整模型或算法作用更明显,推动AI进步应找新数据,如YouTube或具身化数据。

宝玉AI
算法论文8

首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「降成本」秘诀

DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、精度驱动等多方面内容及降成本秘诀。

AI科技评论
新闻资讯7

Kubernetes 被 AI 打回“半成品”!K8s 之父发出警告:代码生成越快,程序员越危险

Kubernetes联合创始人Brandon Burns表示,AI让Kubernetes回到‘未完成’状态,它得适应GPU调度等新需求。他还谈到AI对编程工作的影响,如代码审查成核心技能,未来编程语言或为AI设计。

InfoQ
新闻资讯7

智能体的记忆管理机制及其潜在风险 | 直播预约

语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能的影响及潜在风险,展示缓解关键挑战的策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。

深度学习自然语言处理
开源动态8

AI 真能看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为全模态智能发展提供指引。

机器之心
新闻资讯7

GPT-5准确率不足40%!北大发布多模态、高难度化学基准SUPERChem

北大团队发布多模态、高难度化学基准SUPERChem,构建评估大语言模型化学推理能力新体系。测试显示,GPT - 5准确率仅38.5%,与年级本科生相当,且模型在高阶推理有短板,该基准为模型优化指明方向。

新智元
新闻资讯7

Meta与Scale AI合作出现问题

Techcrunch消息,Meta向Scale AI投资143亿美元并招揽其高管运营超智能实验室,合作仅两月就出问题。人事有变动,TBD Labs与Scale AI对手合作,有人认为其数据质量,Meta否认,投资开局或不利。

AIGC开放社区
算法论文8

华人团队终结Token危机:扩散模型数据潜力超自回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
产品应用8

Midjourney正式推出 V1 视频模型:美学细节无敌

Midjourney推出视频生成模型V1,主打高性价比、易上手。采用“图像转视频”工作方式,有两种动画和运动幅度设置。入门价每月10美元,任务成本,未来一月或调价格,目标是实现实时交互开放世界模拟系统。

AI寒武纪