推理时代」共找到 3158 篇相关文章

新闻资讯8

中国AI芯片大突围,DeepSeek V3.1引爆算力革命

DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。

AIGC开放社区
推荐文章7

国庆这8天,我发现和AI辩论才是最高效的学习方式。

作者国庆假期与AI辩论,以自身关于AI时代信息筛选的观点为例,阐述和AI辩论是高效学习方式。先提出观点,后与AI多轮交锋,过程虽痛苦但能促使人思考、完善观点,还给出与AI辩论三步法。

数字生命卡兹克
开源动态8

一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一

文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。

量子位
7

从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!

90后华裔女高管Cat Wu推动Anthropic产品“按天迭代”,她认为token成本低于工程师工资。她分享了产品发布、团队协作等经验,还谈到AI时代PM应具备的能力,以及Claude系列产品的使用和发展方向。

InfoQ
推荐文章7

ToC智能体火得快,但更大的价值在企业丨中关村科金@MEET2026

在大模型与智能体快速普及当下,中关村科金总裁喻友平判断AI时代核心是连接更强。他提出企业智能化是长期工程,真正让智能体规模化落地需重构底座平台能力,还介绍了应用场景等。

量子位
算法论文8

华为超树HTP:不写示例、不调PDDL,AI规划约束通过率飙升62.6%

文章介绍华为超树HTP,它是完全自主、可泛化的推理新范式。能让LLM在超树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确率并降低token成本,还阐述其原理、创新点及应用实例。

CourseAI
开源动态8

冲上热搜!美团大模型,靠「快」火了

国内外开发者亲测,美团新开源的LongCat - Flash - Chat模型速度超快,推理速度超每秒100个token。它来自美团LongCat - Flash系列,官网可直接用。该模型架构创新,训练方法高效,还做了专属和系统级优化,跑起来又快又便宜。

机器之心
算法论文8

MSRA清北推出强化预训练!取代传统自监督,14B模型媲美32B

微软亚洲研究院联合清北提出全新预训练范式RPT,将强化学习融入预训练,把预训练语料库重构为推理问题集。实验显示RPT-14B表现出色,在多方面媲美甚至超越32B模型,未来RL或在LLM预训练掀起风暴。

量子位
推荐文章8

甲小姐对话郝景芳:从北京折叠到AI折叠 | 甲子光年

这是甲小姐与郝景芳的对话,探讨AI对工作、社会、教育等方面的影响。郝景芳分享创业经历,谈AI编程体验,分析AI时代公司组织、就业、社会阶层变化,还探讨AI应用、素养普及、人类角色等问题,表达对人性和社会发展的看法。

甲子光年
新闻资讯7

MiniMax 技术闭门会分享:长上下文是 Agent 的 Game Changer

MiniMax 7月10日举办M1技术研讨会,探讨模型架构创新等领域。会议围绕RL能否赋予模型新能力、预训练价值等展开,指出长上下文是Agent的Game changer,混合架构将成主流,还分享了混合架构推理实践及M1相关问答。

Founder Park