多语种支持」共找到 4809 篇相关文章

算法论文8

突破单token预测局限!南洋理工首次将token预测引入微调,编程任务准确率提升11.67%

当前主流大语言模型依赖下一token预测训练,难理解跨token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将token预测引入微调,能让模型理解完整概念,领域实验显示其可显著提升模型性能。

量子位
产品应用8

锁定角色,「主体」也可控!个性化文生图,给你PS般交互体验

LayerComposer革新个性化图像生成,能让用户如在Photoshop般操控元素位置、大小,解决传统方法交互性与主体扩展难题。它有分层画布、锁定机制、模型–数据共设计三大特点,实验表现出色,未来将促进人机协同创作。

新智元
产品应用8

证明也有「选择困难症」?腾讯AI Lab与大模型研究部联手打造 MPS-Prover ,视角破解形式化推理瓶颈!

本文聚焦逐步式自动化定理证明器困境,腾讯AI Lab等提出MPS - Prover。它有数据筛选和视角树搜索两项创新,提升搜索效率和证明质量,在基准表现佳,还解决六道IMO难题。

AI科技评论
产品应用7

The Batch:831 | 机器翻译正在实践中发挥作用

人工智能为语言学习应用巨头 Duolingo 带来生产力提升,借助生成式 AI 构建 148 门课程,总量翻倍。其 AI 辅助课程构建法能快速转化语种版本,还在评估模型,不过此举也引发批评。

DeeplearningAI
开源动态8

Jina-VLM:可在笔记本上跑的语言视觉小模型

Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,支持 29 种语言,能高效处理问答等任务,对硬件需求低。

Jina AI
开源动态8

开源AI真人级互动老师,Agent+可视化画布,函数/思维导图实时作图!

本文介绍开源项目ChatTutor,它是可视化互动式AI老师,能边说边画。有数学画布、思维导图等功能,未来将支持代码、物理等画布,可用于解题、备课等,已上线chattutor.app。

开源星探
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
开源动态8

清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练

清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在种大模型上保持端到端精度,代码将分别于6、7月开源。

机器之心
开源动态8

斩获20K星!再见PDF排版噩梦,这个开源神器让文档处理爽到飞起!

MinerU是上海人工智能实验室推出的开源数据提取工具,能将模态文档解析为Markdown,支持精准提取图片、表格、公式,具有语言支持、高性能等特点,应用场景广泛,还开源免费。

小华同学ai
开源动态8

设计师集体沸腾!阿里开源千问图像编辑模型,支持语义及外观的双重编辑!

阿里Qwen团队于2025年8月18日发布Qwen-Image-Edit模型,基于20亿参数的Qwen-Image模型,结合Qwen2.5-VL和变分自编码器,支持语义及外观双重编辑,能精准修改文字,已上线Qwen Chat等。

开源星探