「统一模型架构」共找到 8809 篇相关文章

算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
产品应用7

Claude 5.1来了,但最强能力只向少数机构开放

9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,二者用相同底层模型,区别在安全限制和开放范围。Fable面向订阅用户和企业,Mythos仅向少数审核机构开放,此次还尝试新的开放方式。

AIGC开放社区
产品应用7

当 AI 产品卷向同质化,支付成为最后的增长杠杆

AI应用商业化进入新阶段,头部效应显现,竞争同质化严重。支付成为关键变量,其复杂性远超预想,支付失败损耗大。优化支付需系统诊断,它是商业化基础设施,影响营收。全球支付格局复杂,Payinsider助力企业搭建支付架构。

投资实习所
算法论文8

DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」!

4月30日DeepSeek发布多模态论文,核心是“视觉原语”,让模型边推理边输出坐标。它是七大coding agent玩家中最后接入视觉的,但补课方式反共识,不堆分辨率堆指代精度,效率高,拓扑推理成绩领先。

花叔
算法论文8

ACL 2026|答得更准还写得更短?华为泰勒实验室提出SHAPE,给LLM推理装了个「推理税」

华为泰勒实验室等团队提出 SHAPE,给推理链装「里程碑 + 推理税」机制。它分三步,能统一势能增益度量、阶段难度感知和 token 效率约束。实验显示,它提升准确率、降低 token 消耗,还解决了推理坍缩等问题。

机器之心
推荐文章7

《动手写AI Agent》流式输出:别让用户干等着

文章围绕《动手写AI Agent》流式输出展开,指出此前Ling使用体验差,因无流式输出,用户等待久。介绍主流LLM流式接口基于SSE,对比OpenAI、火山引擎与Claude格式差异,并定义统一的StreamChunk类型。

AI Reading Hub
新闻资讯7

罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token

Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan。

机器之心
产品应用7

Rokid火得太晚了

消费电子市场中AI眼镜迎曙光,乐奇Rokid成AI+AR品类全球销冠。它通过双目衍射光波导和双芯片架构解决轻量化与续航难题,还以开放生态脱颖而出,其判断未来眼镜将成交互主体。

远川科技评论
算法论文8

告别死记硬背!SkillRL自动提炼Skills持续进化

大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。

PaperAgent
新闻资讯8

刚刚!微软 | 发布全新一代自研AI芯片Maia 200

微软提前发布自研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。

AINLPer