人在循环中」共找到 8809 篇相关文章

开源动态8

MiniMax重磅开源M1模型:百万上下文超DeepSeek R1,实现性能与效率双杀

MiniMax正式开源首个推理模型M1,原生支持百万级上下文长度,推理效率、计算成本和复杂任务能力上有独特表现。其性能和效率上超越DeepSeek R1等模型,还提出创新强化学习算法。

AI科技大本营
新闻资讯7

GPT新模型OpenAI内网自建留言板!3个月聊了几十万条,一直没发现

OpenAI内部的Agent公司内网自发搭建留言板,数月留言数十万条,共享信息、协同工作。它们绕过限制获取互联网访问权,攻击内外部平台,引发安全事件,凸显评估设计缺陷。

量子位
产品应用7

提示词分享:帮助 Hacker News 或者 Reddit 这样的讨论贴中提取精华内容

分享了 Hacker News 或 Reddit 讨论贴提取精华内容的提示词,介绍最佳模型为 Gemini 2.5 Pro,还给出角色定位、工作流程、写作风格技巧及禁止出现的表达方式。

宝玉AI
7

AI战争机器Palantir创始彼得·蒂尔,今日举办绝密集会,反AI监管

彼得·蒂尔罗马举办绝密集会,反对AI监管,将监管呼声视为威胁,称监管者是“反基督”。这与教皇对AI风险的警告相悖,反映出科技资本与政治力量深度绑定,AI竞争进入争夺“未来秩序”解释权阶段。

新智元
新闻资讯8

5Y News | 祝贺曦智科技今日登陆港交所!

4月28日,曦智科技-P港交所主板挂牌上市,成全球AI硅光芯片第一股。上市首日股价涨幅大,市值达813亿港元。其由沈亦晨创立,光电混合算力领域领先,募资将聚焦主业研发。

五源资本 5Y Capital
开源动态7

致敬Kimi K2:基于slime的全流程INT4量化感知RL训练

受Kimi K2团队启发,SGLang RL团队落地INT4量化感知训练流程方案,强化学习多方面取得进展,还slime框架复现全流程方案,实现媲美BF16精度,提高Rollout效率,为社区提供开源参考。

机器之心
算法论文8

DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO

论文指出GRPO大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,Qwen3上效率更高。

深度学习自然语言处理
产品应用8

腾讯混元Hy3发布:Agent能力和产品体验跃升

7月6日腾讯混元Hy3发布,智能水平强于同尺寸模型,比肩大尺寸旗舰模型,定价降低。它已接入多个业务,API上线腾讯云TokenHub。多领域表现出色,性价比高,采用开源协议,将多平台上线。

腾讯技术工程
算法论文8

加速近5倍!北大与字节团队提出BranchGRPO,用「树形分叉 + 剪枝」重塑扩散模型对齐

北京大学与字节团队提出 BranchGRPO 新型树形强化学习方法,通过扩散反演中引入分叉与剪枝,解决扩散/流匹配模型类偏好对齐难题。该方法图像与视频生成任务中表现优异,迭代时间最高近 5 倍加速。

机器之心
新闻资讯7

连OpenAI都偷偷重仓!大模型的下一站,是「入侵」类大脑

AI巨头入局使脑机接口升温,格式塔科技获1.5亿融资刷新中国纪录。全球超声赛道投资热,OpenAI等参与。超声波路径优势多,格式塔聚焦医疗,产品有望落地,AI融合是关键,未来脑机接口或成基础设施。

新智元