能碳产业大模型」共找到 10306 篇相关文章

算法论文8

MSRA首测AI从零建仓库:写、跑,但不一定对丨ACL'26

微软亚洲研究院工作RepoGenesis被ACL 2026高分录用,它是面向多语言、仓库级、端到端Web微服务生成的基准。输入贴近实际,用多维度评测开源Agent和商业IDE,还拓展模型微调。但也有边界,未模拟真实复杂需求。

量子位
产品应用7

时隔一年,再次使用7个国产AI大模型写高考作文,国产模型的进步也太大了!有彩蛋。

去年评测国产模型写高考作文力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。

开源AI项目落地
开源动态7

谷歌开源基于物理模拟的气象模型预测暴雨、台风、大干旱

传统通用循环模型处理小尺度有局限,谷歌开源基于物理模拟的神经通用环流气象模型NeuralGCM,在预测突发恶劣天气出色,还介绍其动态核心、物理模拟模块等,经测试有一定优势。

AIGC开放社区
推荐文章8

现有AI都是假实时!Thinking Machines发布交互模型,离真正的贾维斯真的近了

Thinking Machines发布交互模型,切入与AI交互方式问题。该模型原生支持实时交互,由交互和后台模型组成。架构设计独特,解锁多项功,评测表现佳,但也存在长会话、计算部署等局限。

AI寒武纪
开源动态8

9B“小”模型干了票“大”的:性超8倍参数模型,拿下23项SOTA | 智谱开源

智谱发布并开源仅9B大小的模型GLM-4.1V-9B-Thinking,在28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升力,还获10亿投资。

量子位
推荐文章8

林俊旸离职后首度发声:万字复盘,大模型下一站「智体式思考」

前阿里千问负责人林俊旸离职后发文,复盘大模型行业演进,指出 AI 大模型未来主线是智体式思考。文中分析推理模型崛起的启示,探讨思考与指令融合难题,还阐述智体式思维含义、强化学习基础设施挑战等。

机器之心
开源动态8

模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定力维度性推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
算法论文8

为大模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让大模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决大模型深度思考的局限,且适配多种大模型,性价比高。

AI科技大本营
开源动态7

模型精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化
开源动态8

所有环节都上最强模型,这可是做 AI 智体最贵的错误

开源项目 AgentOpt 指出,很多团队做 AI 智体默认把最强模型塞进各环节,既贵效果也未必好。真正决定智体效果和成本的是将合适模型放合适位置,智体需要找最优解的模型优化器。

深度学习自然语言处理