能碳产业大模型」共找到 10477 篇相关文章

产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,力提升30%。它完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
开源动态8

6.2k 谷歌开源LangExtract,主打精确溯源的长文档抽取

谷歌开源 Python 库 LangExtract,让 LLM 依用户指令从非结构化文档提取结构化信息。它可处理临床记录等,具备精确源接地、可靠输出等特性,支持多模型,无需微调,适用于各领域。

PaperAgent
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
新闻资讯8

刚刚!微软 | 发布全新一代自研AI芯片Maia 200

微软提前发布自研AI芯片Maia 200,基于台积电3纳米工艺,性超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。

AINLPer
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,处理一千万token输入。它替代注意力层,训练后在长上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI
开源动态7

Lovart的开源平替产品,完全本地免费的AI设计Agent。

Lovart是热门AI设计Agent但使用成本高,现找到开源平替项目Jaaz。它接OpenAI绘图API,支持Comfyui等本地工具,免费本地使用,功丰富,还将推视频生成功

开源AI项目落地
产品应用8

记忆奇点来临!人类三十万年遗忘被哈佛神经科学家终结

哈佛医学院神经科学家 Gabriel Kreiman 推出 Engramme,旨在赋予人类完美且无限的记忆。它在特定场景下主动推送相关记忆,构建了大记忆模型,有深厚研究积累,已开放 beta 版申请。

AGI Hunt
新闻资讯7

3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归

MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,和用户交互。模型训练用Python和小数据集,视频存档公布助理解原理。

新智元
开源动态7

开源版 Claude Cowork

Multica是原生桌面客户端,将编程智力带给大众,支持Claude Code等。它类似Obsidian,可按需定制,解决编程智体使用障碍,具备简洁界面等特性,还介绍了使用、开发、构建等内容。

GitHubStore
推荐文章7

The Batch: 892 | 教育应与 AI 协作,而非对抗

三年多前ChatGPT发布,教育改变。曾寄望用AI检测器识别生成文本,但学生易规避。检测难维持信任,还可惩罚错对象。生成式AI可提升学习,应构建新评估模型,如展示真实理解等。

DeeplearningAI