专家级表现」共找到 3393 篇相关文章

开源动态8

用 1/1000 的参数打穿大模型:我为什么强烈推荐 PaddleOCR

PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却能在复杂场景媲美大模型精度。其新一代PP - OCRv5全面升,在文本检测等方面表现出色,还稳定增长且在海外受关注。

MacTalk
算法论文8

南大周志华团队最新力作:一个算法通吃所有,在线学习迎来新范式?

世界是动态变化的,AI 模型需具备在线学习能力,领域提出适应性遗憾值指标。现有算法通用性不足,南京大学周志华团队研究具有双重自适应性的通用算法,提出元 - 专家框架等,还研究了在线复合优化问题。

机器之心
开源动态8

月之暗面刚开源多模态Kimi-2506:智能体、视觉理解,重磅大升

国内月之暗面平台对开源多模态模型Kimi-VL-A3B-Thinking升到2506版本。该版本性能、视觉理解等能力提升,支持更高分辨率,在多领域表现出色,还介绍了模型组成与优化器改进。

AIGC开放社区
开源动态8

阿里开源长文本深度思考模型!渐进式强化学习破解长文本训练难题,登HuggingFace热榜

阿里开源长文本深度思考模型QwenLong - L1,登上HuggingFace热门论文第二。它解决了长文本强化学习训练难题,通过渐进式上下文扩展训练,在多基准测试中表现出色,还探讨了SFT和RL作用。

量子位
开源动态8

腾讯Hy3正式版亮相,幻觉率更低,Agent能力更强

7月6日腾讯Hy3正式版上线并开源,总参数量295B。它幻觉率从12.5%降至5.4%,Agent能力大幅提升,在生产力场景表现出色,基准测试结果良好,价格有优势,腾讯内部9条线已接入。

AIGC开放社区
产品应用7

Claude Opus 4.7 上手实测:花7倍价格买输出,值不值?

作者实测Claude Opus 4.7,其定价约为GPT - 4.5的6 - 7.5倍。它有全新架构、强化Agent能力等升,在代码生成、推理分析等多场景表现出色,是否值高价取决于使用场景。

小华同学ai
新闻资讯8

龙虾让位!硅谷顶流AI「爱马仕」一夜闯进微信,冲上全球第一

硅谷新宠Hermes Agent爆火,GitHub揽6.6万星,原生接入微信引开发者关注。其署名的首篇‘顶会’论文提出Autoreason推理方法,指出传统‘自我优化’弊端,展示出小模型逆袭等优势。

新智元
开源动态7

智普入局OCR! GLM-OCR 0.9B 也杀进来了~

OCR是上古任务,如今大模型纷纷入局,用1B以下小参数模型搅动解析市场。GLM-OCR能做文本识别等,采用三架构,有两阶段流水线及训练机制创新,在多场景表现出色。

CourseAI
算法论文8

12毫秒暴露自动驾驶致命缺陷,北航新研究实现场景感知的动态物理对抗攻击|TPAMI2025

近日部分L3自动驾驶车型获批上路,但自动驾驶感知系统存在缺陷。北航等机构提出DynamicPAE框架,实现场景感知的动态物理对抗攻击,解决多维度挑战,在多场景表现优异,被TPAMI2025录用。

量子位
新闻资讯7

前端和后端谁先死?

GPT - 5.1、Gemini 3、Claude Opus 4.5 发布后,都引发前端要死的说法。有截图称前端需全部转型,某大厂前端专家认为这是被自媒体洗脑,还觉得 AI 更易颠覆 CRUD 的后端。

AGI Hunt