DS - Qwen1.5B」共找到 3489 篇相关文章

算法论文7

The Batch: 896 | 教会模型说出真相

大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。

DeeplearningAI
新闻资讯7

Nano Banana 2突然现身!能画公式解数学题,监控画面都能伪造

Nano Banana 2代以预览版现身第三方网站,后被移除。其能力远超1代,能处理复杂提示,可生成复杂UI、解数学题甚至伪造监控画面。谷歌正将Nano Banana整合进核心产品生态。

量子位
新闻资讯7

Claude两个新模型实测流出!空间推理封神,算力直接榨干了

Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。

新智元
新闻资讯8

ChatGPT最强网络安全模型,逼谷歌紧急修漏洞!

OpenAI推出安全专用模型GPT-5.6-Cyber,用于处理信息安全任务。它战绩斐然,发现诸多内核漏洞。Daybreak计划为安全人员提供工具。该模型虽有不足,但展现出强大的网络安全能力。

新智元
产品应用7

全网最详细的Codex入门教程,手把手教你玩转Vibe Coding。

本文是Codex入门教程,介绍其为OpenAI对标Claude code的编程应用,搭配GPT - 5.3 - codex模型。它速度快、额度高、能力强,适合编程小白,还讲解了下载、使用、功能配置等内容。

数字生命卡兹克
开源动态7

新玩法!Karpathy周末手搓“大模型智囊团”应用:各大LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个大模型像顾问般提供建议。查询通过OpenRouter分发给多个大模型,它们互评后由‘大模型主席’生成最终回复,代码已开源。

AI寒武纪
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
产品应用8

谷歌Nano Banana全网刷屏,起底背后团队

谷歌开发者节目展示了Gemini 2.5 Flash Image模型,它能快速生成高质量图像、保持场景一致。文中起底背后团队成员,还介绍模型技术亮点、与Imagen对比及未来能力展望。

机器之心
算法论文8

ParScale:一种全新的大模型Scaling Law

文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。

通义千问Qwen
新闻资讯7

6个月估值翻倍!黄仁勋力荐的AI搜索公司欲开发浏览器取代谷歌Chrome

AI搜索引擎公司Perplexity接近完成5亿美元融资,估值达140亿美元。其搜索引擎产品出圈,获黄仁勋力荐。该公司欲开发AI浏览器Comet取代Chrome,不过面临谷歌等多方竞争。

量子位