「中文字生成」共找到 4547 篇相关文章
AI又封神了!华人新作直出憨豆+《猫和老鼠》,平行宇宙对上戏了
新智元报道,阿联酋MBZUAI团队论文提出CCE和CCA机制,解决AI让不同风格角色同框时的“风格错乱”问题。让憨豆、汤姆等角色自然互动,模型在多角色任务指标上领先,或重写虚构边界。
现在,最会赚钱的AI是Qwen3!全球六大模型厮杀,Top 2来自中国
大模型「炒股」大赛中,阿里Qwen3 Max逆袭DeepSeek夺冠,成「最会赚钱」模型,GPT - 5成「最会赔钱」AI。比赛由Nof1实验室打造,Qwen3 Max成绩体现国产大模型实力。
阿里重磅开源:端到端VLM文档解析模型,图片直出结构化HTML!
在AI文字识别类应用中,文档解析常不尽人意。阿里开源端到端文档解析模型Logics - Parsing,基于VLM,能图片直出结构化HTML,有统一、智能、精细等亮点,还给出使用步骤。
挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智能体系统的失败归因
随着大语言模型发展,多智能体系统潜力大但失败率高。新加坡国立大学等机构研究者提出AgenTracer框架,构建标注管线、设计轻量级追踪器,在失败归因任务上超大型闭源模型,还能助力系统自我提升。
何恺明新身份:谷歌DeepMind杰出科学家
网友爆料何恺明加入谷歌,经确认他以兼职形式成为谷歌DeepMind杰出科学家。可根据其近期研究推测研究方向,他还探讨生成模型能否走向端到端。何恺明履历辉煌,成果众多。
AI一眼认出95万物种,还能分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型
俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性能。它在无相应监督信号的非物种任务中,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。
不只DeepSeek,阶跃等开源JetSpec:大模型解码提速近10倍
近期,DeepSeek 推出 DSpark,阶跃星辰提出 JetSpec,都关注大模型推理效率。DSpark 关注验证效率,JetSpec 提高有效 Token 生成率。二者切入点不同,但都显示大模型行业进入新阶段,推理效率成 Agent 落地基础变量。
分享5个Claude Code + 飞书的超实用Agent办公玩法。
本文分享Claude Code与飞书结合的5种办公玩法,如为会议系列建知识库、工作复盘、自动化对接流程、生成协同画板、自动报销审批等,还介绍飞书CLI能力及安装方式,展现其提效与协同潜力。
谢赛宁新作:VAE退役,RAE当立
谢赛宁团队研究表明VAE时代结束,RAE将接力。RAE是用于扩散Transformer训练的新型自动编码器,能提供高质量重建结果,有语义丰富潜空间,支持可扩展架构,收敛快,在ImageNet图像生成效果强劲。
RSS 2025 软硬件全开源,智源清华带来混动灵巧脸Morpheus
清华大学赵昊团队联合多家机构发布高拟真机器人面部系统Morpheus,融合三项关键技术,能实时生成多种细腻表情。它在核心指标表现出色,有三大创新突破传统瓶颈,为下一代情感机器人奠定技术基座。