多任务训练」共找到 6570 篇相关文章

新闻资讯7

马斯克刚关注了这份AI报告

受谷歌DeepMind委托,Epoch发布报告剖析2030年AI的发展。指出训练成本或超千亿美元,公开文本数据2027年耗尽等,马斯克也关注此报告。还从方面论证发展趋势可延续,且AI将加速领域科研。

量子位
算法论文8

80万条数据揭示隐患:AI正在「污染」病历,你的诊疗数据可能越来越不靠谱

新加坡国立大学等机构团队研究显示,AI生成临床文本用于训练新模型,会使病理信息在数据迭代中消失,降低医疗AI诊断可靠性。研究分析80万条合成数据,还提出缓解方法。

机器之心
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在基准测试领先,支持工具调用,家服务商已集成。

DeeplearningAI
算法论文8

让AI学着“看菜下碟”!港中大等新框架让推理长度减少90%,准确率反增17%

香港中文大学等研究者提出TON选择性推理框架,使视觉语言模型能自主判断是否推理。该框架有两阶段训练机制,实验显示其让推理长度最减90%,准确率还提升,有益模型部署。

量子位
产品应用7

Claude杀入Office全家桶,全球4.5亿打工人一夜变天!OpenAI惨烈出局

微软推出办公神器Copilot Cowork,全面接管Office。它内置Claude模型,能执行任务、运行工作流,可处理日程、会议准备等场景。微软采用模型策略,抛弃OpenAI,Copilot Cowork适合企业,价格较高。

新智元
开源动态7

DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。

DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。

AI进修生
产品应用8

全球首个模态矢量动画生成框架,轻松拿捏跨平台轻量动画

复旦大学等团队推出OmniLottie框架,利用创新分词技术将视频、图文指令变成高质量矢量动画。团队还打造数据集MMLottie - 2M,构建测试基准MMLottie - Bench。实验显示,OmniLottie在任务测试中优势明显。

AIGC开放社区
开源动态8

皮皮虾也来了!超低成本超高效版OpenClaw

PicoClaw是超轻量级个人AI助手,灵感源于nanobot,用Go语言重构。它成本低、内存占用少、启动快,支持架构。还介绍了安装、配置、聊天应用等使用方法,及命令行参考和定时任务功能。

GitHubStore
开源动态8

仅用图像也能Think:Google等提出一种视觉规划的全新推理范式!

剑桥和Google等提出并开源视觉规划范式,通过纯视觉表示规划,独立于文本。还引入VPRL框架,用GRPO后训练大型视觉模型。实验选三个视觉导航任务,VPRL表现最佳,显著优于其他方法。

PaperAgent
算法论文8

高潮从第几秒开始?GaMMA 让模态大模型真正「听懂」音乐时间线

现有模态大模型难以理解音乐时间线。复旦大学与字节跳动团队提出 GaMMA,采用双编码器融合网络,经三阶段训练,还推出 MusicBench 评测基准。实验显示,GaMMA 在基准上表现优异,刷新 SOTA。

机器之心