「多任务训练」共找到 6617 篇相关文章
4B参数实现理解、推理、生成、编辑一体化!InternVL-U重磅开源
上海人工智能实验室联合多所高校开源多模态一体化模型 InternVL-U,仅 4B 参数,突破现有统一多模态模型瓶颈,在复杂场景超越 14B 级模型,已全面开源,提供推理代码等。
如果你想自己搞个Coze?开源版带你上车!(第二期)
文章聚焦想自建Coze平台的用户,介绍几个热门且功能多、有国产化考量的开源项目,如FastGPT、pyspur、sim、aiflowy,涵盖功能、开源协议等信息,助读者打造免费替代品。
这个叫STOP AI 的极端组织要求:立即销毁ChatGPT
Stop AI组织自称「非暴力公民抵抗组织」,发布政府诉求清单,要求禁止训练超10^12 FLOPs神经网络,销毁GPT - 4等模型,还提出多项激进诉求,引发网友热议。
Anthropic8张图,揭示Workflow & Agent的协作场景
文章借Anthropic的阐述,区分了Workflow与Agent概念。指出任务明确用Workflow,开放式问题用Agent,还介绍了构建blocks、workflows方法及Agent工作方式和实施原则。
刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测
Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。
π0引用的中国团队,又出手了:世界仿真器新作发布
Current Robotics团队发布交互式世界仿真器CurrentWorld - 0,创始人祝毅晨履历亮眼。该仿真器能跨本体、多视角、力 - 触觉预测,可用于评测机器人,还能让人类接管以探索不同动作结果。
单卡2秒生成一个视频!清华联手生数开源TurboDiffusion,视频DeepSeek时刻来了
清华大学TSAIL实验室和生数科技联合开源视频生成加速新框架TurboDiffusion,能让视频生成在保证质量下最高提速200多倍,单张显卡就能运行,还整合四项关键技术,有诸多应用意义。
刚刚,OpenAI开源了两个大模型~
OpenAI开源基于GPT - OSS的安全推理模型GPT - OSS - Safeguard - 120B和GPT - OSS - Safeguard - 20B,用于安全用例。有安全推理训练、自带策略等亮点,适配不同显存,采用宽松许可证。
突发!Reddit起诉Anthropic,非法访问10万次
华尔街日报消息,Reddit起诉大模型平台Anthropic,指控其非法访问网站10万次,用用户数据训练AI。Reddit称已和OpenAI、谷歌达成合规合作,此次起诉为求赔偿并让Anthropic履约。
英伟达发布统一GPU开发平台DGX Cloud Lepton
英伟达发布专为开发者设计的AI平台DGX Cloud Lepton,可汇聚全球GPU计算资源,提供即时访问和无缝部署能力。它功能强大,支持多环境部署,提供统一体验,还有庞大合作网络。