半监督评测体系」共找到 1306 篇相关文章

产品应用7

一家智能眼镜公司,为什么非要自研AI大模型系统?|甲子光年

智能眼镜要么不够智能,要么不像眼镜,李未可科技CEO茹忆认为AI要成第一响应者。该公司推三款AI眼镜,搭载自研系统。其自研AI大模型系统,是为交付难复制AI体验闭环,解决通用API不足等问题。

甲子光年
开源动态8

The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战

阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。预训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。

DeeplearningAI
开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
开源动态7

DeepSeek Harness规模化踩坑实录:耗时、成本、失败到底该怎么查

Agent 进入日常研发流程后,使用方关注耗时、Token 消耗和失败回溯。DeepSeek Harness(DSH)是开源 Agent 框架,腾讯云 Agent 可观测提供 DSH 采集插件,构成全景可观测方案,还介绍接入实践与其他能力。

腾讯技术工程
新闻资讯7

智能体时代,我们到底需要什么样的AI人才?|2026 培训年会X极客时间专场

极客时间企业版与主办方联袂呈现DTDS全球数智人才发展大会,探讨智能体时代AI人才培养。多位先行者将分享经验,还有展位活动。极客时间企业版定位为陪跑伙伴,提供三层服务体系助力企业培养AI人才。

InfoQ
算法论文8

从最优传输角度训练奖励模型:让 RLHF 学会「忽略错误偏好」丨ICML 2026

浙江大学、小红书、北京大学等团队提出SelectiveRM,基于最优传输训练奖励模型。它重构训练目标,通过选择性分布对齐排除噪声偏好,解决了奖励模型训练中监督信号不可靠的问题,实验验证其有效且泛化能力好。

AI科技评论
新闻资讯7

人形机器人规模化前夜,硬件供应链是真正的深水区

过去三年,人形机器人行业投资火热,但供应链瓶颈成商业化关键制约。麦肯锡报告分析成本结构,指出执行器是成本大头且供应体系不成熟。全球供应风险分三档,中国供应链有优势,2035年格局或转变。

DeepTech深科技
开源动态8

让大模型理解真实医疗视频,全球首个开源技术方案来了!

AI 进入医疗领域需谨慎,此前美国引入不成熟 AI 致手术失误频发。全球首个医疗视频理解大模型元智医疗视频理解大模型发布并开源,解决了医疗视频领域的任务优化、数据缺失和无法评测痛点。

机器之心
新闻资讯7

为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体

LinkedIn推出认知记忆智能体(CMA),作为生成式AI技术栈一部分,解决大语言模型缺乏状态记忆问题。CMA有三层记忆,集成多种机制,在多智能体系统中作用关键,还将人工校验融入招聘应用。

InfoQ
开源动态8

SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」

腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。

量子位