能碳产业大模型」共找到 10306 篇相关文章

开源动态8

顶尖AI竟输给三岁宝宝,BabyVision测试暴露多模态模型硬伤

UniPat AI 等发布多模态理解评测集 BabyVision,测试显示多模态大模型纯视觉力仅达三岁幼儿水平。其通过对比实验、细分任务评测,揭示模型系统性缺基础视觉力,还给出新方向及发展建议。

AINLPer
开源动态7

里程碑!Artificial Analysis:Mac跑的两款开源模型正式追上GPT-5

据Artificial Analysis报告,32B以下开源模型比肩GPT - 5。Qwen3.5 27B、Gemma 4 31B分别与GPT - 5中杯、小杯智水平相当,虽知识全面性落后,但智体表现和批判性推理进步大,硬件门槛低。

AI寒武纪
推荐文章8

AI 编程 2025 总结:国产模型力追平”,国产编程工具还在“情感陪伴”

文章总结2025年AI编程发展,指出国产编程模型力追平、工具与模型开放集成等六大趋势,同时提到AI替代重复劳动、提升核心力门槛,呼吁2026年关注工程确定性。

phodal
开源动态7

毫秒响应延迟!开源统一语音对话模型Voila

Voila是开源统一语音对话模型以自发、实时且有情感的方式与人类互动。它采用全新端到端架构,响应延迟仅195毫秒,支持超百万种预构建声音,适用于多种语音应用。

带你学AI
算法论文8

98%准确率!这个双分支AI模型,精准识别木薯叶病害(附代码)

2026年3月论文DenseSwinV2提出双分支AI模型,结合CNN与Transformer,加通道注意力模块突出病害特征。该模型分类木薯叶病害准确率达98.02%,还给出简化版代码,有落地价值。

机器学习AI算法工程
算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
开源动态8

用 1/1000 的参数打穿大模型:我为什么强烈推荐 PaddleOCR

PaddleOCR是百度开源的OCR工具,模型参数仅0.07B,却在复杂场景媲美大模型精度。其新一代PP - OCRv5全面升级,在文本检测等方面表现出色,还稳定增长且在海外受关注。

MacTalk
算法论文8

Anthropic:大模型开始意识到自己在想什么!

Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

深度学习自然语言处理
推荐文章7

OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型

CourseAI
开源动态8

必须基于世界模型?我们和蚂蚁灵波团队聊了聊

上周图灵奖得主 Yann LeCun 认为真正的智在脑海推演,而大语言模型难以触及真实世界。2026 年初,蚂蚁灵波连续四天开源四款具身智模型,探索从物理交互构建智的新路径。

机器之心