「思考模型」共找到 8049 篇相关文章
2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。
文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。
摩尔线程天使投资人:对近期AI的四十个观察
摩尔线程天使投资人王捷整理关于AI经济四十个问题,涵盖模型发展、经济影响、就业冲击等方面,如Scaling Law收敛、AI扩散时间、数字层机制等,为探讨AI经济提供观察视角与分析框架。
刚刚,Anthropic发现Claude「类意识工作台」!神秘J空间藏着没说出口的想法
Anthropic新研究发现Claude内部存在特殊“J空间”,像静默心理工作区,浮现模型思考概念,不一定在回答里。此研究受关注,还揭示其特性、发现方式及应用,改变对Claude“心智”理解。
年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川
年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。
独家|地平线前高管牛建伟成立叮当动力,专注空间智能,获地平线领投数千万元投资
《AI科技评论》独家消息,前地平线智能座舱产品线总经理牛建伟创立叮当动力,专注空间大模型的通用具身智能,获地平线领投数千万元种子轮融资。牛建伟经验丰富,团队提出独特解决方案,产品聚焦多元场景。
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
2 天斩获 3.5K 标星!GitHub 惊现神器!一个二进制文件把 DeepSeek V4 搬进终端
GitHub上的DeepSeek TUI项目开源两天获3.5K Star,它把DeepSeek V4模型搬进终端成编码智能体,有原生RLM并行推理等亮点,提供多种安装方式、支持多提供商,适合终端开发者。
Notion Custom Agents复盘:三年重写5次,Notion 历史上最成功的新功能之一
Notion 的 AI 工程负责人 Sarah Sachs 和技术负责人 Simon Last 在采访中分享 Agent 探索思考。Custom Agents 是 Notion 历史上转化率高的新功能,开发三年重写 5 次。他们还谈及产品路线、模型评估、技术方向等内容。
后训练中的RL已死?MIT新算法挑战传统后训练思维,谢赛宁转发
MIT研究人员提出RandOpt新算法,挑战传统后训练思维。该算法通过随机扰动和集成突破限制,在多任务中表现出色,揭示了预训练模型权重空间的“神经丛林”现象,引发AI社区关注。
科幻!谷歌放出Gemini Robotics-ER 1.5:机器人有了真正的思考力
谷歌推出首个广泛开放给开发者的机器人具身推理模型Gemini Robotics - ER 1.5,可作为机器人高级推理大脑。它能解决物理问题,有新能力如快速空间推理等,还能让开发者平衡延迟与准确性。