弱到强监督」共找到 2268 篇相关文章

算法论文8

原来Veo 3早有苗头!人大联合值得买科技在CVPR 2025提出全新「图像有声视频」生成框架

中国人民大学与值得买科技团队在CVPR 2025提出JointDiT框架,可从静态图像生成同步音视频。此研究定义图像有声视频生成新任务,解决音视频融合难题,实验显示其效果优,还将拓展至四模态建模。

机器之心
新闻资讯7

Agent 不是渐进升级,而是要“换代”了:Cursor 工程负责人放话未来三六个月,行业将迎来大变局

本文是对Cursor工程负责人Jason Ginsberg的访谈。他认为编码Agent正换代,未来三六个月行业将大变,会接管复杂任务。还谈及编码Agent发展、Cursor使用方式、交互模式等,分享了产品开发、审查等看法。

InfoQ
推荐文章7

直播预约 | 如何缓解LLM-as-a-Judge的潜在偏好?UDA:一种无需人工标注的无监督去偏对齐框架

论文针对不同大模型对同一组大模型回答打分差异大等问题,提出无需人工标注、模型无关、即插即用的UDA框架,以无监督方式动态调整Elo评分,实验表明该方法能降低打分标准差、提升与人类评分相关系数。

深度学习自然语言处理
新闻资讯7

“代码 + 编译器”要消失了?马斯克在 xAI 全员会上放话:今年年底,AI 或将直接生成二进制

xAI 近期出现离职潮,马斯克公开全员大会视频回应。他表示离职是阶段适配问题,还预测 2026 年底 AI 或直接生成二进制,跳过编程。此外介绍了 xAI 新架构及各团队进展,强调基础设施重要性,甚至提及将算力扩展月球。

AI前线
产品应用7

真香!我用AI做PPT的血泪史:从“能用”“真香”,V3版底解决了什么?

作者因公开分享需做PPT,尝试多种AI PPT工具后,自己围绕Agent攒了一个。从V1V3版不断改进,V3用多Agent提示词用法,风格多样且规则减少,还给出3步制作PPT的方法及后续功能拓展想法。

AI 产品自由
开源动态8

WRC整理床铺机器人背后模型曝光!端端双系统全身智能VLA,仅凭少量微调就能get任务

星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源。

量子位
开源动态8

超低延迟的端端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超低延迟等优势。

开源星探
产品应用7

单张消费级显卡也能参与大模型训练!无问芯穹用「三个盒子」打通十万卡一张卡AI效能跃升路径

2025年WAIC上,无问芯穹联合创始人夏立雪带来AI落地新解——三个盒子,即无穹AI云、无界智算平台、无垠终端智能,是面向未来的智能基础设施设计,能打通从十万卡一张卡的AI效能跃升路径。

量子位
新闻资讯7

Zig 创始人直言,Bun 靠 Claude 生成的 Rust 重构版是“没人把关的烂代码”

Bun创建者用Claude智能体11天将Bun从Zig移植Rust,虽通过测试,但Zig创始人Andrew Kelley批评其编程实践不规范,认为代码是‘没人把关的烂代码’,且AI生成代码缺监督会出问题。

InfoQ
开源动态8

阿里Qwen3技术报告核心要点解读!

阿里Qwen3技术报告发布,披露模型架构、预训练及后训练等技术细节。其有密集与混合专家两种模型架构,预训练数据量和语种增多,后训练采用强蒸馏提升性能,各模型表现优异。

PaperAgent