「多语言数据集」共找到 6575 篇相关文章
OOM排查之路:一次曲折的线上故障复盘
文章复盘了整合Paimon数据湖与RocksDB的系统三次OOM故障排查过程,分享曲折经历,介绍MAT、NMT等排查工具,还给出内存问题排查思路,望为相似技术栈者提供启发。
中国电信天翼AI发布首款AI眼镜,星辰大模型开启第一视角智能交互新时代
在2025世界人工智能大会上,中国电信天翼AI发布全球首款融合自研“星辰大模型”的智能穿戴设备——天翼AI智能眼镜,依托云网融合与星辰大模型,开创第一视角智能交互新范式。
从 Hadoop 到 Kubernetes:Pinterest 在 AWS EKS 上的可扩展 Spark 架构
Pinterest将基于Hadoop的数据平台替换为Moka,这是在AWS EKS上运行Spark的Kubernetes原生系统。Moka实现容器化作业隔离,支持ARM实例,改进调度、简化部署,降低成本、提高效率。
阿里开源电影级AI视频模型!MoE架构,5B版本消费级显卡可跑
阿里开源新一代视频生成模型通义万相Wan2.2,含文生视频等功能。它率先将MoE架构用于视频生成扩散模型,5B版本可在消费级显卡部署。对比前代和Sora表现更优,还推出电影级美学控制系统。
重磅!Meta开源通用神经输入系统!人人可用的非侵入式手环登场
Meta开源通用神经输入系统,用基于手腕的输入技术结合上下文感知AI带来新交互体验。关键技术EMG可读取大脑电信号,将其转成数字命令,系统表现优秀,为“隐形”人机交互奠基。
微调重要表征以增强思维链的推理能力
团队提出关键表征微调(CRFT)方法,通过信息流分析识别和优化关键表征。在八个数学和常识推理基准及两个模型系列验证其有效性,能提高推理准确率,学习参数量低,还适应少样本场景。
OpenAI拿IMO金牌是火了,但惹怒大批人:抢发炒作,抢学生风头
OpenAI宣布其模型在IMO竞赛得分35/42获金牌,十分高调。但IMO曾要求AI公司赛后一周公布结果,避免抢学生风头。谷歌很低调,OpenAI却提前公布,引发不满。此外,其金牌成色也遭质疑。
OpenAI新Agent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先
昨日凌晨,OpenAI推出ChatGPT Agent新功能,标志其踏入“智能体人工智能”领域。虽官方称该功能性能先进,但实际效果有局限。海外网友对比发现,它被中国24人初创团队产品Genspark等碾压。
Transformer危!谷歌MoR架构发布:内存减半推理速度还翻倍
谷歌推出全新底层架构Mixture-of-Recursions(MoR),推理速度提高2倍、KV内存减半,首次在单一框架实现多任务处理与动态分配计算资源,研究人员通过实验验证其性能超Transformer。
苹果向英伟达生态妥协了!MLX框架主动适配CUDA
苹果特意为端侧AI模型训练推出的MLX框架,主动增加了CUDA支持。因CUDA在AI开发领域占主导,且生态强大,苹果此举是借力英伟达生态、扩大自身影响力的战略选择,也避免侵权。