新全栈」共找到 5133 篇相关文章

算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3范式GSPO

文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

SFT在帮倒忙?研究:直接进行强化学习,模型多模态推理上限更高

学界常用「监督微调(SFT)+ 强化学习(RL)」训练大模型。但研究发现,SFT 会引发「伪推理路径」,阻碍推理进步。相比之下,直接进行 RL 训练,模型多模态推理上限更高,该团队训练的模型还刷了纪录。

机器之心
产品应用7

编程进入「对讲机」时代!Claude抢发语音写代码,转录Token免费

Anthropic给Claude Code加语音模式,输入 /voice,长按空格说话即可输入,转录Token免。OpenAI的Codex也更类似功能。语音编程在Debug、架构讨论等场景好用,但识别变量名等仍有短板,未来编程将多模态。

新智元
产品应用8

刚刚,OpenClaw最猛升级!底层架构大换血,网等了9天

OpenClaw「2026.3.22-beta.1」预览版上线,对插件系统重构,SDK替代旧API,ClawHub成首选分发渠道;安防护升级,封堵多个漏洞;模型配置升至GPT - 5.4,接入Anthropic Vertex等;多平台体验和Agent引擎也有优化。

新智元
开源动态7

谢赛宁也玩MC?开源世界模型生成多人一致的游戏视角

电子游戏推动AI发展,谢赛宁团队探索世界模型方向,推出多人视频世界模型Solaris。该模型能生成多人一致的第一视角,团队还搭建了多人数据采集系统SolarisEngine,构建了多人Minecraft数据集。实验结果显示,其方法在多方面表现更优。

机器之心
开源动态7

智谱模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
开源动态8

面向长时语音与声音克隆的模态开源万能聊天机器人MGM-Omni

文章介绍了模态开源聊天机器人MGM - Omni,它基于MiniGemini,支持多模态输入输出,具备长语音理解、生成、流式生成、零样本语音克隆等特性,还给出安装、使用方法,展示评估结果。

GitHubStore
新闻资讯7

5个月估值翻10倍,AI数据赛道跑出一家独角兽

成立约18个月的AI训练数据公司AfterQuery正筹一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安风险待解。

DeepTech深科技
开源动态7

R1一周年,DeepSeek Model 1悄然现身

2025年1月20日,DeepSeek发布DeepSeek - R1开启开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。

机器之心
开源动态8

华为开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革

机器之心