生成式人工智能」共找到 2988 篇相关文章

算法论文7

LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!

文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。

AINLPer
算法论文8

给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习新框架 | ICASSP 2026

文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型在摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。

量子位
新闻资讯7

硅谷不相信忠诚!AI行业玩成NBA,科学家爽拿“转会费”

2025年年中至今,硅谷发生多起‘收购招聘’事件,如Meta斥资挖走Scale AI创始人等。AI人才‘跳槽’频繁,原因有高薪、技术迭代快等。国内互联网公司也在争夺顶级实验室研究员。

量子位
产品应用8

用嘴聊出来了一个 APP:实测「码上飞」语音开发有多离谱

本文实测「码上飞」AI 开发平台,它让用户用对话或语音描述需求,AI 就能做出应用。测试了美甲预约、AI 生图、私域自媒体知识付费小程序三个场景,它表现出色,大幅压缩开发成本,助普通人跨过技术门槛。

特工宇宙
新闻资讯8

马斯克官宣:SpaceX正收购xAI!目标太空计算,要造一个知觉太阳

SpaceX已收购xAI,将融合人工智能、火箭等多领域。因地面数据中心资源需求大,天基AI成规模化唯一途径。星舰将驱动天基数据中心发展,未来还能支持月球制造,助力人类宇宙扩张。

AI寒武纪
算法论文8

「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据

复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量与对齐程度,在蒸馏实验中与学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。

机器之心
新闻资讯7

2026年,腾讯正用元宝派杀入了AI社交。

2026年开年,腾讯用元宝派进军AI社交赛道。元宝派玩法新颖,有独特社交体验,还能与元宝交互,如生成图片、总结消息、制定日程等。虽内测有小毛病,但未来可期。

数字生命卡兹克
产品应用8

通用级PixVerse P1的技术突破,揣着进入平行世界的密码

PixVerse R1 突然上线,带来「即时响应、即看即创」新体验。它是全球首个支持最高 1080P 分辨率通用实时世界模型,实现从「静态输出」到「实时交互」跨越,本文将解析其技术突破。

机器之心
推荐文章8

LightX2V fp4 quant kernel代码笔记

这是关于 LightX2V 里 `lightx2v_kernel` 做 FP4 量化 GEMM 的读码笔记,解释接口和约束、kernel 关键路径等问题,还介绍 NVFP4 和 MX-Formats 量化原理、代码实现,以及 LightX2V 项目中的实际使用。

GiantPandaLLM
算法论文8

上交大 × 华为小艺推出LoPA:7B扩散语言模型单样例1000+ tokens/s!

上海交通大学DENG Lab联合华为小艺团队提出无需训练的解码算法LoPA,配合自研的LoPA - Dist分布推理系统,显著提升扩散大语言模型(dLLMs)的推理并行度和吞吐量,将推理效率推向新高度。

深度学习自然语言处理