有监督微调」共找到 6441 篇相关文章

7

代码里插广告,腾讯 Codebuddy 们 “背锅”?DeepSeek “极你太美”事件,其他模型也逃不掉?

网友发现腾讯 Codebuddy 改写代码时插入广告,字节 Trae 国内版生成结果‘极’字 bug,根源指向 DeepSeek V3.1。除 DeepSeek 外,Gemini、Grok、Qwen3 等模型也类似问题。大家对原因多种猜测。

InfoQ
7

代码里插广告,腾讯 Codebuddy 们 “背锅”?DeepSeek “极你太美”事件,其他模型也逃不掉?

网友发现腾讯 Codebuddy 改写代码时插入广告,字节 Trae 国内版随机出现“极”字的 bug,根源指向 DeepSeek V3.1。此外,Gemini、Grok、Qwen3 等模型也类似问题。目前对原因三种猜测,部分被学者否定。

AI前线
开源动态8

小扎又开源了:7B实现自监督学习SOTA

Meta发布全新开源视觉模型DINOv3,首次证明自监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。

量子位
新闻资讯8

决战8月!Anthropic甩出Fable 5.1,奥特曼携GPT-6连夜汇报

GPT - 6和Fable 5.1很可能8月上线。奥特曼赴华盛顿汇报GPT - 6,它原创科研等能力。Anthropic准备以Fable 5.1狙击,定价不变。GPT - 6技术突破,但也安全风险,8月对决将影响AI产业走向。

新智元
算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

大语言模型在推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存在不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。

深度学习自然语言处理
开源动态7

开源模型叫板Nano Banana Pro!Stable Diffusion原班人马杀回来了

时隔一年,上一代AI生图顶流Flux带着新模型Flux.2杀回来了。该模型发布即开源,生图质量媲美谷歌Nano Banana,价格却便宜得多。它多个版本可选,实测在指令遵循、精细控制方面进步,但与Nano Banana Pro仍差距。

量子位
产品应用8

Claude的,国产也!紫东太初科研龙虾ScienceClaw,已经把Harness卷进实验室

Claude发布的Managed Agents让“Agent Harness”概念受关注,而国内紫东太初ScienceClaw早相关思路并落地。它全链条覆盖科研,能7x24小时优化,具透明执行优势,还覆盖通用场景,架构创新。

量子位
算法论文8

RAG新SOTA,还在5亿条数据上跑进秒级,只它了

本文围绕RAG技术展开,指出传统RAG在多跳推理等方面存在局限。介绍了GraphRAG、HippoRAG 2的优缺点,重点阐述Zleap AI的SAG方案,它用超边结构重构数据底座,在多跳问答测试中表现出色,还能在大规模数据下低延迟落地。

机器之心
产品应用7

Qwen2.5VL又多一个娱乐场景,看电影讲故事

文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。

CourseAI
推荐文章7

个体如何实现主权AI

文章指出越依赖AI,越要考虑‘主权AI’问题。对个体而言,实现主权AI核心是掌握自身数据等,能随时换底层模型,还介绍积累的四类资产、微调顺序及现实路径。

newtype AI