原力灵机」共找到 391 篇相关文章

开源动态7

强迫模型自我争论,递归思考版CoT热度飙升!网友:这不就是大多数推理模型的套路吗?

近日,概念CoRT火了,它在CoT基础上加了“递归思考”,能让AI递归思考响应、生成替代方案并选最优,结合“结构化自我批判”提升推理。不过网友质疑它是“新瓶装旧酒”。

机器之心
开源动态7

100k Star,他们给Clawdbot升级了超级记忆

Clawdbot项目突破100k,后改名moltbot。其记忆是静态的,此次升级为超级/动态记忆,构建三层记忆系统,让理解自我更新。还集成Supermemory,有自动回忆等功能,文章给出实施指南。

PaperAgent
新闻资讯7

GPT-5-Thinking新训练方法公开:让AI学会忏悔

OpenAI提出忏悔训练Confessions,让ChatGPT自己“坦白从宽”。在GPT - 5 - Thinking上实验有效,模型犯错后多会坦白,且更诚实,不影响任务表现。还介绍了训练方法、实验结果及局限性。

量子位
7

Cursor也挖人了:Claude Code开发主管和产品经理被一锅端

编程神器Cursor母公司Anysphere挖到合作伙伴Anthropic两名前核心高管,Claude Code开发负责人和产品经理将分别任Cursor首席架构师和产品负责人。这或使两家合作关系微妙,AI编程领域竞争激烈。

AI寒武纪
产品应用7

作业帮基础观测能之一监控体系实践

本文介绍作业帮监控体系实践。其监控体系随云生成长,支持全集群监控。构建时选 Prometheus 采集、VictoriaMetrics 存储,还从多维度采集指标,用自研代理降成本、治理指标,让系统更贴合研发。

InfoQ
开源动态8

DeepSeek多模态新范式:一张图压缩7056倍,思考能反超GPT和Claude

DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。

AIGC开放社区
新闻资讯8

Anthropic最新2026趋势报告:人类最大一次编程革命势不可挡

Anthropic发布《2026年智能体编码趋势报告》,指出编程规则改变,任何人都能成开发者。报告给出8大趋势,如软件开发生命周期剧变、智能体能提升等,还给出2026年组织需关注的4大领域。

新智元
产品应用7

Thinking Machines 发布 Tinker API,实现灵活的模型微调

Thinking Machines公司发布Tinker API用于开放权重语言模型微调,可减少开发者基础设施开销。支持多种模型架构,集成LoRA,还发布开源存储库。虽有竞品,但Tinker侧重暴露低级语,尚处封闭测试。

AI前线
新闻资讯7

Agent 的 Token 账单怎么省?

AI 行业从生成式能向 Agent 行动跃迁,核心矛盾转向推理成本可控性。随着企业将 Agent 编入自动化流水线,Token 消耗受关注,业界开始聚焦以「降本」为核心的技术路线。

机器之心
新闻资讯7

Anthropic刚刚牵手SpaceX,Claude直接用上22万张H100+轨道AI算,马斯克也要上天了

Anthropic官宣与SpaceX签算大单,拿下Colossus 1数据中心全部算供Claude用,还将共同开发太空算。这是在GPT - 5.5压下的反击,且Anthropic此前已签多笔算大单。

鲸选AI