多任务训练」共找到 6583 篇相关文章

新闻资讯7

Mythos逼谷歌再拉红色警报!布林连夜成立Coding突击队

Claude Mythos来势汹汹,谷歌拉响红色警报,布林和CTO成立Coding特攻队。团队重点提升模型复杂编程任务表现,还将内部代码纳入训练数据,且推动员工用编程工具。

量子位
开源动态8

刚刚开源就斩获 2.7K Star!吴恩达老师开源了一个 AI 员工 OpenWorker!

吴恩达老师开源了桌面 AI Agent OpenWorker,对标闭源 Agent。它能交付成品,本地优先、支持模型,重要动作需审批。有 25+ 连接器,支持定时任务和角色模板,提供方式上手。

开源星探
算法论文8

北大王选所彭宇新团队:让模态大模型学会「看懂物种关系」丨CVPR 2026

北大王选所彭宇新团队在论文中提出TARA方法,引入生物分类学知识与模态模型中间表征对齐。实验显示,TARA能提升模型层级识别和未知类别识别能力,还可加速训练收敛,计算开销小。

AI科技评论
产品应用8

打造Jarvis,OpenClaw很野,但Agent Studio简直变态

文章介绍OpenClaw和Agent Studio两个AI Agent项目。OpenClaw能打通AI Agent与消息应用,适合技术团队搭建基础设施;Agent Studio可打造个人Agent工作台,重点展示其接入企微流程,还介绍四大核心功能。

腾讯技术工程
算法论文8

微软:LLM上下文学习并非真的学习!

微软研究指出大模型上下文学习(ICL)虽数学上符合学习定义,但只是拟合prompt内统计规律,非掌握任务本质。通过大量实验,得出如例子越模型表现越好、语言不重要统计重要等7条关键发现。

PaperAgent
算法论文8

打破视觉Token的算力诅咒,RedundancyLens如何为模态大模型推理减负

模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于场景。

PaperAgent
产品应用7

企鹅终于跟进了:OpenClaw 接入企微,一个企微群,我管住了 Win、Mac、手机,还能@不同AI 专家

微信不开放,企业微信却允许 OpenClaw 接入。其接入简单,还具特色机制与主动性通知。文中介绍了 OpenClaw + 企微等玩法,如 Bot 群聊、跨设备控制等,最后给出企微接入 OpenClaw 保姆教程。

AI进修生
算法论文8

细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破模态数学推理瓶颈

香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。

量子位
算法论文7

Anthropic 新研究:AI出错是“热混乱”

Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。

AI工程化
开源动态8

人会话视频生成新突破:香港科技大学,浙江大学用单人数据实现人交互视频生成

香港科技大学、浙江大学等开源 AnyTalker,提出音频驱动人交互生成新范式。它用创新机制和两阶段训练策略,以少量数据实现人视频生成,还构建评估指标,性能超现有方法。

AIGC开放社区