「多任务架构」共找到 6432 篇相关文章
阿里开源Qwen3-Coder-Next,80B参数仅激活3B的MoE顶尖编程助手
阿里开源小型MoE代码模型Qwen3 - Coder - Next,总参数量800亿但仅激活30亿参数,在代码生成等任务表现出色。团队构建训练技术栈解决数据匮乏,模型训练分阶段,多领域专家模型能力整合,基准测试性能强劲。
天塌啦!!!这个开源项目让我失业啦,1300+ Star的开源AI画布,牛到让你怀疑~~~
介绍了 1300+ Star 的开源 AI 画布 Infinite - Canvas,它以画布为创作统一入口,有独特架构和多协议适配,具备多种实用功能、生态插件及两种画布模式,部署简单但需配置,适用于多场景,有优点也有局限。
3.8K Star!港大开源 AI 量化神器:一句话生成量化策略,普通人也能玩懂!
港大开源的Vibe - Trading在投资圈火了,它是AI驱动的多智能体金融工作台,能将自然语言请求转化为交易策略等。有多智能体协作架构,内置64个金融技能、29个智能体团队预设,提供4种安装使用方式。
又一款国产高性能GPU问世,实力对标海外巨头
2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。
高效大规模创新3D重建模型iLRM
多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。
LeCun新作反杀AGI派!AI连「鸟」都搞不懂,拿什么超越人类?
图灵奖得主Yann LeCun联手斯坦福团队最新论文揭示,LLM仅在粗糙分类任务表现优秀,精细任务却失灵。研究测试30多个大模型,得出三大发现,指出LLM与人类在概念形成和信息处理上存在本质差异。
十载磨「芯」:云天励飞冲击港股AI推理芯片第一股
7月30日,云天励飞向港交所递交H股上市申请,迈向“A+H”新阶段。它是中国首家实现国产高算力AI推理芯片商业化的公司,坚持“全自研、国产化”,现进一步聚焦AI推理芯片,构建“1+N”业务架构。
阿里开源 Team 版 OpenClaw,5分钟完成本地安装
阿里开源 Team 版 OpenClaw——HiClaw,它是 OpenClaw 超进化版,引入 Manager Agent 角色,解决了 OpenClaw 在安全、多任务协作、移动端体验、记忆管理等方面的痛点,还集成多个开源组件,部署简单,适合开发者和企业。
千问接入淘宝、闪购、飞猪,意味着什么?
2026 年初千问升级,上线任务助理并接入淘宝、闪购等。其能处理常见任务,但更重要的是可解决用户衣食住行等实际问题,虽目前部分场景待优化,但阿里有优势,不过千问也面临体验、协同和商业化挑战。
OpenCode AI编程实践:利用推理路由低成本开发游戏
文章介绍用 OpenCode 结合 DigitalOcean 推理路由器开发点球大战游戏 PK Shootout。其按任务选模型,多数任务路由到 MiMo V2.5 和 GLM - 5.2,成本约 8.25 美元,远低于只用前沿模型。文中还分析开发各环节及适用场景。