残差连接」共找到 513 篇相关文章

算法论文7

The Batch: 861 | 拥有AI朋友的人感受更

斯坦福和卡内基梅隆大学研究人员调查1131名Character.AI用户,分析其使用行为与心理健康相关性。发现依赖聊天机器人陪伴与较低幸福感相关,但未确认因果关系,开发者应关注产品负面影响。

DeeplearningAI
推荐文章7

Clawdbot 之后,我们离能规模化落地的 Agent 还什么?

OpenClaw爆火,但在企业和商业环境中存在昂贵、不可控等问题。Monolith砺思资本技术沙龙探讨Agent规模化落地难题,指出需关注稳定性等指标,还分析了数据成本、训练速度、基础设施、状态管理等方面的困境与解决思路。

Founder Park
新闻资讯7

GPT-5.2降智遭全网评!奥特曼慌了

OpenAI推出GPT - 5.2,却未打赢谷歌。第三方数据显示Gemini 3 Pro更优,GPT - 5.2在多项基准测试表现不佳,可信度不如GPT - 5.1,遭开发者吐槽。OpenAI为此调整策略,但仍处被动。

新智元
新闻资讯7

点被Ilya摁掉,胎死腹中!ChatGPT爆红内幕首次公开

本文深度揭秘ChatGPT爆红内幕,从产品发布、命名内幕到团队文化等方面展开。还提及OpenAI内部对发布的争议,以及ChatGPT发布方式的转变,同时指出依赖用户反馈改进模型存在的问题和OpenAI看重的人才特质。

新智元
产品应用7

2025 社交新方式:当 AI 成为「第二个我」,去实现「真实连接

作者作为业余AI产品经理,体验Second Me这款AI应用。它能借助AI复刻「AI自我」,基于记忆匹配社交,作者借此完成与他人的深度交流。同时探讨了AI社交风险,认为AI应是社交起点,帮人筛选和破冰。

特工宇宙
推荐文章7

只会「氛围编程」,永远成不了真正工程师!还这几个关键环节

火遍全网的「氛围编程」(Vibe Coding)让编程门槛降低,但与专业软件工程师仍有距。文章解析了距所在,如AI编程需精确指令,软件工程复杂,对程序员「品味」要求变高,还探讨了编程未来及Vibe Coding的挑战。

新智元
推荐文章8

同一个模型,换套框架成绩27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
新闻资讯7

直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?

为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。

深度学习自然语言处理
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理
新闻资讯7

阿里财报暴跌7%,华尔街却集体喊买入——这里有个逻辑

3月19日阿里发布2026财年Q3财报,股价跌7.3%。散户看到净利润暴跌、现金流为负,华尔街关注阿里云增长与AI潜力。文章分析财报,探讨钱去向、风险及投资决策。

AI Reading Hub