超参数调优」共找到 2664 篇相关文章

开源动态8

19.2K Star!Linux上无缝运行Win应用,酷~

在Linux系统下运行Windows应用一直是难题,开源项目WinBoat能让Linux用户无缝运行Windows应用,通过容器和远程桌面技术,将Windows应用变Linux原生窗口,还具备自动化部署等多样功能。

开源先锋
开源动态8

开源医疗模型SOTA:蚂蚁健康发布百亿参数医疗大模型

由浙江省卫生健康信息中心、蚂蚁健康等联合开发的AntAngelMed医疗大模型正式开源。它凭借独创训练与架构,在权威评测中表现优异,降低算力门槛,将专业知识、诊疗能力与计算架构融合,为医疗AI落地奠基。

AIGC开放社区
算法论文8

RL成本降幅90%!Meta提出Agent训练新范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。

深度学习自然语言处理
产品应用7

Qoder + ADB Supabase :5分钟GET火AI手办生图APP

本文介绍如何用Qoder、阿里云ADB Supabase和通义千问图像编辑模型,快速搭建AI手办生图Flutter移动端应用,无需自建传统后端,涵盖思路、环境准备、各环节配置及流程等内容。

阿里云开发者
新闻资讯7

250份文档就能给大模型植入后门:不分参数规模

Claude母公司Anthropic联合英国AISI和图灵研究所研究发现,仅250份恶意文档就能给不同规模大模型植入“后门”漏洞,打破了以往对大模型数据中毒的认知,给厂商提了个醒。

量子位
新闻资讯8

市值1500亿!江西宜春小镇走出“光芯片之王”

在全球AI算力竞赛白热化阶段,天孚通信创始人邹支农凝视新获专利的光接收器组件。他从江西宜春高安农村走出,攻克日本垄断的光通信技术,将公司市值推至1548亿,还在家乡投资兴业。

芯师爷
开源动态8

万亿参数狂欢!一文刷爆2025年七大顶流大模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
算法论文7

视觉+语言+动作!强具身“训练宝典” EmbRACE-3K

视觉 - 语言模型在具身环境中表现有局限,港大推出 EmbRACE - 3K 数据集应对。它含 3000 多个任务、2.6 万个决策步骤,有细致多模态注释。团队用其微调 Qwen2.5 - VL - 7B 模型,还建立新基准评估多个模型。

带你学AI
推荐文章7

垂直赛道 Agent 闷声发财指南:如何实现一年千万营收?

本文围绕垂直赛道的2B Agent展开,分享了语核科技创始人的产品理念与经验,探讨了如何找到有价值的场景、构建高价值闭环。还介绍了客户的应用情况、对Agent的看法及选型考量,强调其商业价值与落地挑战。

Founder Park
产品应用8

新模型亦是新 Agent,Kimi-Researcher 大量一手实测!

2025 年被称为“Agent 元年”,月之暗面发布了端到端强化学习训练的新一代 Agent 模型 Kimi - Researcher,其基座是自研新模型。文章对其进行大量实测,与 OpenAI 等对比,并探讨了 Deep Research 的重要性及 Kimi 的不足。

特工宇宙