「多语言处理」共找到 5414 篇相关文章
NeurIPS事件发酵,多位学者拒绝出任AC
NeurIPS因美国法规不接收华为等受制裁实体投稿,引发学术界震荡,许多学者不满。中国计算机学会发声反对,呼吁学者拒绝服务与投稿,已有学者拒任领域主席,还引发对其他会议的担忧。
理解Ray Data分布式数据处理原理-源码分析
Ray Data是构建于Ray之上的分布式数据处理库,提供高性能且可扩展的API,可用于AI场景。文章从源码入手,分析其流式执行原理,包括读取数据源、构建数据处理、输出数据等环节,还介绍了LogicalPlan转PhysicalPlan及流式执行过程。
大厂这波Agent混战,杀死10多个AI名品
2026年8月AI圈组织架构调整频繁,阿里、字节整合多款产品,腾讯、百度也有动作。办公Agent成大厂混战核心,虽有产品被整合,但各厂优势不同,终局难测。
LangFlow: 挑战离散扩散,探索下一代语言模型新范式
UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。
Kimi新出的Agent集群,到底有多恐怖?
Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,多项评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。
One RL to See Them All?一个强化学习统一视觉-语言任务!
国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。
Codex 装进 iPhone 后,开发者每天多 3 小时生产力时段
5月14日,OpenAI将Codex塞进ChatGPT手机App,所有套餐包括免费版都可解锁。Codex手机版定位是AI代理遥控器,解决远程开发安全顾虑,解开“人类必须坐在电脑前”束缚,还催生新工作流。
刚刚,何恺明团队新作,「嵌入式语言流」ELF来了
何恺明团队提出ELF模型,将扩散过程置于连续向量空间,只在最后翻译成词。它用一个网络实现去噪和解码,引入自条件机制。实验显示,ELF用不到其他方法十分之一数据,生成质量全面领先。
The Batch: 873 | 通过自监督学习实现更好得图像处理
Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。
Qwen2.5VL又多一个娱乐场景,看电影讲故事
文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。