弱到强监督」共找到 2269 篇相关文章

产品应用8

从 1000 万 App 下载 1 亿桌面:千问与夸克合体成 AI 浏览器了

阿里千问 App 公测 7 天下载量破千万,其基于强大的 Qwen 模型。11 月 26 日,千问与夸克 AI 浏览器深度融合发布 6.0 版本,借助夸克超 1.1 亿的装机量,千问成系统级桌面智能助理。

MacTalk
产品应用7

用户被通知烦关掉 Instagram?Meta:我们反思了,用 AI 给自己“限流”

Meta为Instagram推出新机器学习排序框架,引入‘多样性算法’,在现有互动模型上加‘多样性过滤层’,通过‘乘性惩罚’减少重复内容推送,解决通知疲劳,还计划探索新策略和用大语言模型优化。

InfoQ
算法论文8

清华大学x生数科技:从波形隐空间,AudioLBM引领音频超分新范式

音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。

量子位
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低 1,也能匹敌全参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
新闻资讯8

「从追赶者引领者,路有多远?」 我们和CANN一线开发者聊了聊

AI浪潮下,硬件竞争转向软件等生态之战,华为昇腾及其CANN站在变革前沿。本文与开发者对话,探讨CANN开源意义、早期挑战、演进及未来战略,开源将带来技术透明、生态赋能等红利。

机器之心
产品应用8

百度用50天将视频价格打行业70%!内部负责人:成本优化还有空间

8月21日百度蒸汽机音视频一体化模型重大升级,实现多人有声视频一体化生成。有五大核心技术突破,价格低至行业70%。源于算力和工程优化积累,未来还会优化成本,其盈利不依赖调用次数,带动平台生态升级。

AI前线
开源动态8

500美元刷新SOTA!训练成本砍1/200,华人团队重构视频生成范式

香港城市大学等团队发布图像 - 视频生成模型Pusa V1.0,在基础大模型上引入VTA机制,用3860对视频 - 文字数据、约500美元微调,在I2V超越Wan - I2V - 14B实现SOTA,还解锁零样本任务能力。

量子位
产品应用7

实测Gemini图片转视频新功能,终于蹲经典梗图后续了(doge)

Gemini接入带声音的图片转视频功能,作者实测该功能。用开盒指令测试,生成速度较快;还尝试给梗图加后续,发现生成精确内容需详细提示词,且不能生成具体真人形象内容。

量子位
开源动态8

深夜开源首个万亿模型K2,压力给OpenAI,Kimi时刻要来了?

昨晚,月之暗面发布并开源 Kimi K2 大模型,同步上线更新 API,价格 16 元/百万 token 输出。它超过多个开源和闭源模型成新 SOTA,展示出领先能力,还介绍训练关键技术,或成模型智能进化关键。

机器之心
算法论文8

UIUC提出隐式监督新范式:无需标注/RM即可全面提升多模态Reasoning的感知能力

大型多模态模型在复杂多模态推理中面临挑战,67%错误源于视觉感知缺陷。为此,UIUC提出PAPO,通过隐式感知损失提升模型感知能力,无需额外标注,在多模态基准上表现优异,还解决了KL黑客问题。

深度学习自然语言处理