有监督微调」共找到 6427 篇相关文章

新闻资讯7

Murati翁荔陈丹琦公司发布首个产品,让大模型微调门槛暴降,要重新发明一个OpenAI

Thinking Machines Lab发布首个产品Thinker,让模型微调像改Python代码一样简单。它是用于微调语言模型的灵活API,降低了大模型微调门槛,受到业界关注。此外,该公司还尝试重新发明OpenAI,而OpenAI正打造社交模式。

量子位
算法论文8

为什么自监督永远学不到语义?

《Visual Language Hypothesis》论文用纤维丛理论审视视觉表征学习,指出只做连续变换难触达语义。分析现监督学习不足,提出“Expand - and - Snap”机制,还通过实验验证,提供审视AI架构新视角。

深度学习自然语言处理
新闻资讯7

Google说,2026年AI Agent会这五大趋势!

Google Cloud发布2026年Agent趋势报告,认为能改变业务的转折点是Agentic AI,总结了五大趋势,如人人都Agent、流程自动化等,核心是让员工成Agent管理者和协调者。

探索AGI
产品应用7

小红书,再造一个更「声」命力的社区

2026年春节,小红书开放多种AI语音新玩法,如语音发布、评论、问一问等,增强社交趣味性。但AI语音落地面临音频理解、生成活人感和响应速度等问题。小红书天然优势,技术团队自研模型达SOTA水平。

机器之心
算法论文8

StereoAdapter:北大首提自监督,适配水下双目深度估计

水下机器人深度感知难题待解,北大等机构提出StereoAdapter框架。它结合单双目视觉,以自监督学习适配视觉基础模型到水下域,设计双阶段结构、自监督训练策略等,实验效果好,未来还将多方面改进。

新智元
推荐文章8

大模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
产品应用8

Qwen3.5实战教程:从0到1掌握本地部署与微调

阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。

机器学习AI算法工程
新闻资讯7

OpenAI个神秘邮箱,多大点事都能惊动奥特曼

OpenAI扩张中启用friction机制,员工遇问题可发邮件到friction@openai.com,重要问题能惊动高层。该机制由Fidji Simo制度化,虽人不满,但在竞争中利于消除内部堵点,对手也各管理法。

机器之心
新闻资讯7

微软AI新天团曝光!只1位华人,「谷歌系」超1/3

微软AI CEO苏莱曼领导的17名核心高管阵容曝光,新增9名核心成员中5位来自谷歌(包含DeepMind)系,8名老将中2名来自苏莱曼共同创办的Inflection AI。新核心团队将聚焦AI产品落地、安全与隐私、增长与商业化。

新智元
新闻资讯7

WebAssembly 3.0 发布,64 位内存、垃圾回收全都,先别激动,组件模型还没做完!

WebAssembly 3.0 发布, 64 位内存、垃圾回收等特性,但备受期待的组件模型未完成。虽未迎来‘Docker 时刻’,但服务器端生态进展,不少平台已实现‘类组件’能力。

InfoQ