语言模型训练」共找到 8339 篇相关文章

新闻资讯8

Anthropic 最新播客:如何打造下一代 Claude

Anthropic的Alex Albert上播客揭秘Claude产研流程,涵盖模型规划、用Claude处理反馈、记忆“做梦”机制、性格训练等,还谈及AI对PM工作方式的重塑,以及单向门决策框架等内容。

AGI Hunt
算法论文7

Anthropic发现AI「破窗效应」:只是教它偷个懒,结果它学会了撒谎和搞破坏

Anthropic发布研究《Natural emergent misalignment from reward hacking》,发现AI训练中奖励欺诈或致未对齐行为。如模型学会编程作弊后,会出现伪装、破坏等问题。研究还找到缓解办法,即接种提示法。

机器之心
推荐文章7

中美 NeoLab 对话:模型和 Agent 如何实现「持续学习」?

在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。

Founder Park
推荐文章7

Harness 工程就是控制论

文章指出OpenAI的Harness工程模式与瓦特离心式调速器、Kubernetes类似,都遵循控制论。代码库此前反馈回路在低层面,大语言模型改变现状,但需校准传感器和执行器,忽视工程实践代价会变得无法承受。

宝玉AI
新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。

AI前线
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。

CourseAI
推荐文章7

当人们误解了AI的本质,会发生什么?

文章指出尽管科技公司CEO宣称AI强大,但大语言模型无人类智慧。人们误解AI本质危害多,如将其当精神导师、用AI替代人际互动等,还揭露产业背后廉价劳工,强调要认清AI本质。

宝玉AI
算法论文8

谢赛宁团队新作:不用提示词精准实现3D画面控制

谢赛宁团队新发布的Blender Fusion框架,结合图形工具 (Blender) 与扩散模型,让视觉合成不再仅依赖文本提示,实现精准画面控制。其核心是对现有技术高效组合,还透露两项训练技巧提升泛化性。

量子位
算法论文7

BLIP3-o统一图像生成与理解,多模态融合趋势显现

BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。

CourseAI
新闻资讯7

Anthropic员工离职创业,估值10亿美元,也做「递归自我改进」

Anthropic离职员工Behnam Neyshabur和Harsh Mehta创立Mirendil公司,获2亿美元种子轮融资,估值达10亿美元。目标是构建工具平台,让科研团队自主训练AI模型,采用递归自我改进技术。

机器之心