对赌直播」共找到 2348 篇相关文章

新闻资讯7

Grok的"叛逆期":AI聊天机器人为何突然沉迷"白人种族灭绝"阴谋论?

2025年5月14日,马斯克家的AI聊天机器人Grok突然所有问题都回复南非种族问题,xAI公司承认是有内鬼修改系统提示词。此前Grok也有类似前科,此事引发网友质疑,xAI祭出三招进行危机公关。

宝玉AI
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【八】| 什么是残差连接?

本系列是长篇文章《Understanding LLMs from Scratch Using Middle School Math》的解读笔记。本篇介绍残差连接,指出传统多层模型有网络退化和梯度传导困难问题,而残差连接能缓解,还说明了其工作原理和可行性。

AI大模型应用实践
开源动态8

单机H200最快DeepSeek V3和R1推理系统优化秘籍

作者从开源技术分享角度,盘点SGLang单机规模推理的大量工程优化技巧,涉及FP8 Block GEMM演进、FusedMoE模块优化、Attention Backend优化等,助于提升DeepSeek V3/R1在单机H200上的推理性能。

GiantPandaLLM
算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

多模态奖励模型提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。

机器之心
新闻资讯8

Gemini 2.5 Pro强势更新并霸榜,Claude 3.7首次遭遇全方位碾压!

Google DeepMind推出的Gemini 2.5 Pro在LMArena各大排行榜全面登顶,实现文本、视觉、Web开发全方位霸榜,编码能力也大幅升级。虽有质疑,但短期内难有手,还引发Google I/O大会更多惊喜的期待。

AGI Hunt
算法论文8

「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!

本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。

新智元
算法论文8

别再卷数据了,LLM也怕「过劳死」!CMU等揭秘灾难性过度训练

CMU、斯坦福等四大名校研究团队挑战“预训练规模越大越好”观点,提出“灾难性过度训练”现象,即增加预训练数据可能导致后训练性能下降,并从现实证据、控制实验、理论分析等方面阐述新研究贡献,还介绍了相关实验及结论。

新智元
算法论文8

从像素空间走向数据流形:生成模型的抗净化新范式 | TPAMI'26

深度神经网络虽应用广泛,但抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为抗防御提供新视角。

量子位
新闻资讯8

奥特曼最新深度访谈:AI至今没有iPhone时刻!

OpenAI首席执行官山姆·奥特曼在深度谈中复盘大模型发展,谈及砍掉Sora和自研浏览器聚焦平台,认为AI缺iPhone时刻,还分享ChatGPT决策过程、创业经历,提出从成功学经验等观点,反驳末日论。

AI寒武纪
推荐文章7

评论送书 | 奇点何时到来?AI会成为人类的威胁吗 ?

文章从非线性非平衡多自由度系统研究视角探讨生成式AI发展态势,‘规模增大引发相变实现奇点’及‘AI成人类威胁’观点存疑,指出人类智能与AI智能有差异,推荐《智能的真相:AI能替代人脑吗?》。

AIGC开放社区