开练」共找到 194 篇相关文章

推荐文章7

AI 编程越来越厉害了,我要怎么提升自己的系统架构能力?

文章指出 AI 写代码能力提升,对程序员系统架构能力要求更高且难被替代。介绍系统设计概念,分析做系统设计的难点,给出新人提升系统设计能力的方法,还说明 AI 可辅助提升该能力。

宝玉AI
开源动态8

DGM:首个可通过重写自己的代码来实现进化的AI Agent

Sakana AI发布Darwin Gödel Machine(DGM),可通过重写代码自我进化,突破了当前AI Agent智能固定的局限。它在多测试中表现出色,能力具通用性,但也有潜在风险和局限,团队已源并提出未来研究方向。

AGI Hunt
开源动态8

AI始玩乐高了?我拼一小时的乐高,它几秒就搭好,LegoGPT源了!

卡内基梅隆大学提出LegoGPT,是首个依文本提示生成物理稳定乐高积木模型的方法。构建了StableText2Lego数据集,训自回归大模型生成设计,还发纹理生成法,设计能手动或机器人组装。

带你学AI
新闻资讯7

最具争议的 1 人 AI 公司融了 3000 万美金,估值达到了 2.5 亿

1人AI公司Polsia引发大量质疑,有人认为它是“垃圾产品”,指出其ARR统计、客户流失率等问题。但它刚完成3000万美金融资,估值达2.5亿美金,网站月流量超100万。

投资实习所
产品应用8

源的 skill 被抄了千赞,我用 Lovart 给自己做了个品牌!

作者源剪辑 Agent 被抄赞多,决定为账号做品牌视觉。其非设计师,用 Lovart 改变与 AI 沟通方式,通过 Brand Kit、字体生成器等完成系列设计,还能导出 PSD,沉淀 Skill。

AI产品自由
开源动态8

美团智能体SOTA模型LongCat-Flash-Thinking-2601

美团龙猫团队源智能体推理模型LongCat - Flash - Thinking - 2601,总参数5600亿。该模型在多方面有卓越表现,团队通过构建数据、模拟环境、采用强化学习策略及设计高效架构等,使其比肩闭源模型。

AIGC开放社区
算法论文7

思维链推理是一种脆弱的‘海市蜃楼’,一旦超出训分布,它便会消失。| 直播预约

思维链提示能提升LLM在多任务上的表现,让人感觉模型在深思熟虑。但研究从数据分布角度剖析,发现思维链推理是脆弱的‘海市蜃楼’,超出训分布就会消失,强调实现通用推理能力挑战大。

深度学习自然语言处理
开源动态7

DeepSeek-OCR降本增效,10×暴力压缩还能读得清

Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训流程,还展示其用较少token超越现有模型的能力。

CourseAI
算法论文8

ICLR 2026 Oral|大模型总爱「想太多」? DECS从源头消除冗余思考,实现推理token减半且性能不降反升

以DeepSeek - R1等为代表的大型推理模型存在过度思考问题,造成大量冗余计算。复旦大学等团队在ICLR 2026 Oral论文中揭示‘长度惩罚’局限性,提出DECS框架,在多基准测试中实现推理长度减半且性能提升。

机器之心
开源动态8

告别大模型“失忆”!人大源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前大语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已源。

PaperAgent