「零样本学习」共找到 1788 篇相关文章
视频生成Prompt何须仅是文字!字节&港中文发布Video-As-Prompt
AI视频生成中,依赖抽象语义控制的创作因缺乏统一条件表征而困难。字节与港中文团队提出Video - As - Prompt框架,引入‘视频参考’范式,实现抽象语义下可控视频生成范式统一,代码和数据集已开源。
你以为在点「红绿灯」验证身份,其实是在给AI免费打工
验证码发展多年,从最初文本形式到如今图像形式。用户点选验证码时,实际在为AI免费提供训练数据,如谷歌让全球网民免费转录资料、为自动驾驶AI打工。如今验证码攻防战激烈,未来或利用AI弱点创新。
用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率大幅提升
扩散大语言模型发展迅猛,或成下一代大语言模型基础范式有力竞争者。复旦大学等团队发布论文,提出高效解码策略与强化学习训练组合,解决MDLM解码和训练问题,提升推理性能与效率。
从兼职工程师直接跳到CTO,他用两个月让一款 Agent 干掉60%复杂工作并放话:“代码质量与产品成功没有直接关系”!
金融科技公司 Block 的 CTO Dhanji R. Prasanna 分享公司 AI 转型经验。Block 在 8 周内部署 AI 智能体,推出开源 AI Agent 框架 Goose,能节省员工工时,还谈到组织变革、AI 应用及招聘等多方面见解。
南华期货 x TencentOS:如何实现CentOS操作系统的“无感”切换?
2024年南华期货与腾讯合作,依托TencentOS Server完成200余套操作系统迁移,实现核心业务零事故切换。其分三阶段实施,TencentOS Server以无感迁移、稳定性强、利于生态协同等优势获选,迁移成效显著。
自主金融研究智能体
Dexter是自主金融研究智能体,会思考、计划和学习。它能将复杂金融问题转化为研究计划,利用实时数据执行任务、自我验证。介绍了其核心能力、安装使用方法、架构、项目结构、配置等。
SOTA级的Embedding模型!F2LLM模型、数据、代码全部开源,人人可用
Embedding 模型应用广泛,但主流模型训练困难。蚂蚁集团与上海交大推出 F2LLM,含 0.6B、1.7B、4B 系列模型,仅用六百万数据微调基座,在 MTEB 榜单领先且完全开源。介绍了其数据、训练、测评等情况。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
奥特曼:感受不到GPT-5变强,是因为你还不够「专业」
GPT-5发布后口碑不佳,直播事故、网友吐槽、专家唱衰不断,有人喊出‘AI第二次寒冬要来了’。但奥特曼认为这是节奏和期待错位,GPT-5在科研等高阶领域有提升,技术范式也有转变,且OpenAI仍看重规模。
腾讯重磅开源:端到端文档转换VLM,中英文错误率双料最佳!
腾讯开源端到端文档转换视觉模型POINTS - Reader,可将文档图片转结构化文本。它基于POINTS1.5架构,支持中英文。在OmniDocBench基准上,中英文错误率暂列最佳,具零后处理简单等亮点。