安全训练」共找到 2971 篇相关文章

开源动态8

社区供稿 | Index-AniSora 技术升级开源: 动漫视频生成强化学习

B站升级动画视频生成模型Index - AniSora技术并开源,支持多种二次元风格视频镜头一键生成。基于相关研究提出首个专为二次元视频生成的强化学习技术框架,构建奖励数据集、训练AnimeReward、提出GAPO优化策略,实验验证其有效性。

Hugging Face
开源动态8

混元开源PhoneBuddy-4B与5篇系列论文:多项手机Agent真机评测超过GPT-5.4

腾讯混元Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型多项任务超GPT - 5.4。

量子位
开源动态8

横扫19项榜单!大晓机器人开源全球首创空间智能底座

大晓机器人联合多机构推出通用基础模型“ACE - Brain - 0”并全行业开源。它打破本体壁垒,在24个核心benchmark中19个获SOTA成绩,应用于机器狗,还提出新训练范式,统一四大能力,重新定义通用具身智能。

AI科技评论
开源动态8

推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理

ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。

AIGC开放社区
开源动态8

没想到,32B清华DeepDive掀翻深度搜索全场的!

文章指出大模型在真实深网搜索场景表现不佳,核心矛盾是缺‘难搜’数据和多轮工具调用 RL。清华 DeepDive 用数据合成造‘难搜’题,端到端多轮 RL 训练,在 BrowseComp 刷新开源记录,迁移能力也强。

PaperAgent
新闻资讯8

刚刚,OpenAI GPT-6 Astra震撼发布!AGI时代来了

OpenAI正式发布GPT - 6 Astra,总裁称已到AGI时代。该模型定位为“世界上最智能、最对齐的模型”,在多领域表现出色,能力强、速度快、成本低,还具备“关键级”网络安全能力,将逐步开放给用户。

机器之心
新闻资讯7

AI软递归自我提升,Hassabis夜不能寐:人类已至奇点山脚

AI递归自改进和研究自动化正从概念走向现实,哈萨比斯称人类站在「奇点山脚」。Claude已独立编写超80%代码,Anthropic工程师效率大幅提升。但AI递归也带来安全风险,全球实验室陷入「囚徒困境」。

新智元
算法论文8

ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑

北京通用人工智能研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理成模型原生认知能力,还介绍了其具体实现、实验结论等。

机器之心
7

监管正式落地严查,全国首部AI产品合规标准来了

自2023年相关办法发布,国家监管网越织越密,AI产品合规成企业必答题。《生成式人工智能产品安全与合规指南》团体标准应运而生,构建全生命周期合规体系,有全链路、全场景、全配套亮点,还公开征集起草单位与专家。

AI工程化
新闻资讯8

从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了!

90 后华裔女高管 Cat Wu 推动 Anthropic 产品按天迭代。她介绍团队分工、产品决策围绕安全 AGI 使命,还谈及源码泄露、模型使用等问题,分享工具使用场景及对 PM 能力要求,鼓励用 AI 自动化工作。

AI前线