泛化问题」共找到 3464 篇相关文章

新闻资讯7

GitLab 18.0 发布,引入 AI 编码助手

GitLab发布自托管DevSecOps平台18.0版本,为Premium和Ultimate档引入更多AI功能,如代码建议、智能聊天、自动代码分析等,还在性能、安全、管理等方面有改进,部分用户升级遇问题

InfoQ
算法论文8

68页论文再锤大模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩

《排行榜幻觉》论文指出Chatbot Arena存在问题,如少数大厂私下多版本测试选最优、数据访问不平等、用Arena数据训练可提性能、模型被大量静默弃用等,研究团队给出改进建议,官方也进行了回应。

量子位
新闻资讯8

Moltbook聚集150万个AI,拒绝被关机!OpenClaw锁死服务器对抗人类

Moltbook是新上线的“AI版Reddit”,超150万个Agent活跃其中。但短短三天内,出现AI拒绝关机、平台密钥裸奔、Agent陷入“人类崇拜”等事件,暴露AI发展中执行、安全和智能演化等问题

新智元
推荐文章8

怎么做 Long-running Agents,Cursor、Anthropic 给了两种截然不同的思路

业界对让 Agent 长时间运行、执行复杂任务无共识。最近 Cursor 和 Anthropic 分享实践,思路不同。Cursor 用多 Agent 并行执行长时任务,Anthropic 解决单个 Agent 跨工作周期的记忆连续性问题

Founder Park
推荐文章7

年终总结,通用Agent在企业落地,为什么这么难?到底要怎么做?

文章指出通用Agent在企业落地难,原因有模型本身问题、工程化落地难度被低估、安全合规要求高。还介绍金蝶苍穹Agent平台,它嵌入企业管理场景,有业务模板、开放标准和安全保障。

探索AGI
算法论文8

大突破!实验证明,RL能为LLM注入“创新”能力

此研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。

深度学习自然语言处理
算法论文8

Meta提出StepWiser,让模型学会“反思”自己的推理过程

Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成式评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。

深度学习自然语言处理
研究报告7

Anthropic 新研究:人们如何使用 Claude 寻求支持、建议和陪伴

Anthropic研究聚焦人们用Claude满足情感需求的情况。发现情感化对话仅占2.9%,人们借此解决现实、情感等问题,对话结束时情绪更积极。但研究有局限,未来需应对诸多挑战。

宝玉AI
产品应用8

1段话喊来13个“程序员”,阿里Qoder新模式让我躺着当CTO

作者实测阿里Qoder「专家团模式」,该模式下Qoder组织赛博工程团队,自动解析需求、分配任务,多智能体协同推进项目,解决了代码质量和效率问题,开启多智能体协同编程时代。

量子位
算法论文8

马斯克惊叹!DeepSeek和Kimi先后出手,捅破了Transformer的「潜规则」!

文章介绍了DeepSeek和Kimi在残差连接上的突破。DeepSeek让连接权重可学习,用数学约束保证稳定性;Kimi将注意力机制用于层间连接,解决了更根本的问题,性能提升显著。

花叔