手写文本识别」共找到 727 篇相关文章

算法论文8

何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升

何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。

量子位
开源动态7

字节开源了一个了不得的模型!

字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。

探索AGI
新闻资讯7

AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退

Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。

新智元
产品应用7

Claude Code 推出安全审计插件,边写代码边抓漏洞

Claude Code上线官方安全插件security - guidance,能在写代码时自动识别并修复安全漏洞。它分三层防线,覆盖多种漏洞类型,还支持自定义安全策略,安装方便,但只是辅助工具。

AGI Hunt
推荐文章7

社会奖赏激进的人?真相比你想的更残酷

文章探讨社会是否奖赏激进者。从AI使用场景引出话题,指出心理学上冒险者有优势,但存在幸存者偏差。提出应采用杠铃策略,在不对称风险中果断行动,同时强调并非所有领域都适合激进。

AI Reading Hub
算法论文8

LLM时代的事件抽取:从静态任务到认知脚手架

此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。

深度学习自然语言处理
新闻资讯7

基于百万亿 Token 的 AI 使用模式分析:趋势、拐点与未来|PPT分享

近期OpenRouter报告《人工智能现状:基于OpenRouter的100万亿Token实证研究》,分析超100万亿个token的真实世界LLM交互数据,弥补LLM实际使用情况证据不足,揭示2024年转折及多方面发现。

AI大模型应用实践
开源动态7

能自动把PDF转换为可填写表单的开源工具,实用可落地。

CommonForms是能自动将PDF转换为可填写表单的开源工具,通过检测文本框等自动添加交互字段。它基于YOLO11做目标检测,支持CLI和API使用,有多种功能特点,能高效处理转换。

开源AI项目落地
开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。

Hugging Face
算法论文8

Attention Sink产生的起点?清华&美团首次揭秘MoE LLM中的超级专家机制

清华和美团研究聚焦MoE LLM,首次发现超级专家子集。通过多模型实证分析,揭示其分布规律、重要性及对注意力机制的影响,开发识别工具,为模型压缩提供新方向。

机器之心