从零训练」共找到 4895 篇相关文章

新闻资讯7

GPT-5系列咋都爱说「哥布林」?原因找到了

OpenAI发布博客解释模型迷上「哥布林」的原因。原来是训练“Nerdy”人格时,奖励信号偏爱怪物词汇,强化学习将风格固化并扩散到普通对话。此前DeepSeek V3.1也出现过「极」字Bug。

机器之心
7

我花499找人上门安装OpenClaw,看到了AI时代最魔幻的一幕。

作者花499元体验OpenClaw上门安装服务,发现市场价格混乱,30到5000元不等。安装师傅非技术出身且自己少用该工具。同时指出OpenClaw有安全隐患,提醒大家别因恐惧盲目安装。

数字生命卡兹克
8

Claude Code 之父的自白:非科班、辍学,却要革程序员的命

Claude Code创建者Boris Cherny做客访谈,回溯Meta转至Anthropic的动机,称大模型是新生命形态,影响会重塑社会。还谈及Claude Code发展,不好用到成主力,揭示软件工程正经历结构性重写。

InfoQ
新闻资讯8

60秒极限挑战!中国GPU独角兽杀出重围,斩获图形顶会大奖

2025年12月,SIGGRAPH Asia 2025在香港开幕,摩尔线程在3DGS重建挑战赛中凭自研技术LiteGS斩获银奖。该团队还开源3DGS基础库LiteGS,实现全链路协同优化,提升训练效率与重建质量。

新智元
新闻资讯7

Anthropic逃过一劫:成功和解万亿美元版权诉讼,避免破产

Anthropic与作者达成和解,避开12月审判和可能高达万亿的赔偿。此前法官裁定其用盗版内容训练模型属盗版行为。和解为行业划红线,数据需明确来源授权,Anthropic仍面临其他版权挑战。

AGI Hunt
新闻资讯7

谷歌技术报告披露大模型能耗:响应一次相当于微波炉叮一秒

大模型耗电舆论高,谷歌用数据还击。谷歌首席科学家称Gemini能耗低于预期,一年间能耗降至1/33,碳排放降至1/44。谷歌用更全面指标计算能耗,还多方面优化使Gemini能耗降低。

量子位
算法论文8

大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
开源动态8

南洋理工、北大、上海AI实验室开源长记忆世界模型

目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。

AIGC开放社区
新闻资讯7

Meta 再挖角4名OpenAI 华人研究员!网友:希望给的钱不要比Yann LeCun 多……

The Information报道,Meta再OpenAI挖走四名关键华人研究员,这是第二波挖角。此前Meta刚斥巨资收购股份并挖来华裔CEO。此次挖角引发各方反应,也凸显AI人才竞争激烈。

AGI Hunt
产品应用7

Claude Code 强大的秘密究竟是什么?

Claude Code 强大源于其强大模型基础、丰富实用的内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI 的 Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据。

宝玉AI