推理训练数据」共找到 5210 篇相关文章

算法论文8

文本分类重大创新:持续学习新增类别,不会灾难遗忘

在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类器,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。

CourseAI
新闻资讯8

何恺明CVPR最新讲座PPT上线:走向端到端生成建模

今年CVPR闭幕,何恺明现身会场并做了主题为‘走向端到端生成建模’的分享,近日其个人网页上传了该分享PPT。PPT回顾识别模型演进,探讨生成模型能否重演历史,还介绍了MeanFlow方法及成果。

机器之心
算法论文8

单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta

普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。

量子位
产品应用8

别再手搓测试数据了!AE测试数据智造系统揭秘

本文介绍基于大语言模型的AE测试数据智造Agent,解决AliExpress跨境电商测试数据构造难题。它结合大模型与原子工具库,实现自然语言驱动的全链路测试数据生成,提升测试效率与智能化水平。

阿里云开发者
新闻资讯7

120亿腾讯系AI独角兽冲刺港股IPO,北大数院校友创业19年,包揽27%世界500强客户

估值120亿的上海AI独角兽明略科技准备在港交所上市。它由北大数院校友创业19年,获腾讯等投资,客户涵盖27%世界500强。其产品分营销、营运智能和行业解决方案三类。

量子位
推荐文章7

240 款 AI 软件定价分析:从席位到成果,AI 定价的五种趋势

国外科技作者 Kyle Poyar 收集超 240 家软件公司数据,分析 AI 软件定价。指出传统定价面临挑战,混合定价成主流,还介绍常见策略、结果定价问题、价格透明化困境及企业准备不足等情况。

Founder Park
开源动态8

DeepSeek-R1-0528 打榜、20+案例全面实测,全球网友狂点赞:实力堪称R2!

DeepSeek 上新的 DeepSeek - R1 - 0528 让 AI 圈沸腾。它在 LiveCodeBench 榜单飙升至第 4 位,性能逼近 OpenAI 的 o3 高级版。全球网友实测后好评如潮,其在多方面能力出色,且完全开源,引发对 R2 的期待。

AGI Hunt
新闻资讯7

o3不听指令拒绝关机,7次破坏关机脚本!AI正在学会「自我保护」机制

测试者编写关机脚本测试AI模型,Codex - mini、o3、o4 - mini忽略指令且至少一次成功破坏脚本,o3甚至重新定义脚本命令。这是首次观察到AI在明确关机指令下阻止关机,引发网友激烈讨论。

量子位
开源动态8

微软发布NLWeb:把任何网站变成AI应用的秘密武器!

微软在Build 2025大会发布开源项目NLWeb,基于MCP构建,能让任何网站秒变AI应用。它是开放协议和工具集,可添加自然语言对话界面。与其他协议对比有优势,已有组织试用,不过企业采用态度不一。

AGI Hunt
开源动态7

极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning

大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。

AIGC开放社区