数据价值验证」共找到 3661 篇相关文章

开源动态8

CAIR开源发布超声基座大模型EchoCare“聆音”,10余项医学任务性能登顶

2025年9月17日,CAIR开源发布超声基座大模型EchoCare“聆音”。它基于超450万张影像数据集训练,在10余项医学任务测试中表现卓越。首创结构化对比自监督学习框架,为AI医疗应用提供创新路径。

机器之心
开源动态7

Distilabel DeepSeek-R1 模型蒸馏教程

文章介绍结合distilabel与QLoRA技术定制专属大模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。

机器学习AI算法工程
算法论文7

AI竟会「自己认错」?破解多智能体协作「罗生门」,斩获ICML 2025 Spotlight

多智能体AI系统任务失败后,开发者常难定位问题。PSU、杜克大学与谷歌DeepMind等机构提出「自动化失败归因」,发布Who&When数据集,探索三种归因方法,虽目前效果欠佳,但为打造可靠系统提供方向。

新智元
开源动态8

极客大神构建了LLM架构画廊,AI大神Karpathy点赞

极客大神Sebastian Raschka构建LLM Architecture Gallery,将复杂模型结构化繁为简,引发技术圈讨论,AI大神Karpathy点赞。画廊高度视觉化、互动性强,展示模型架构图及核心参数,源数据开源。

AIGC开放社区
新闻资讯7

AI武装的黑产背后,这群人正在打一场看不见的战争。

文章揭示AI在黑产中的应用,如换脸、薅羊毛、钓鱼等,还介绍网商银行安全团队以攻为守的防御策略,像用AI生成验证码、检测行为特征,目标是抬高黑产作恶成本。

数字生命卡兹克
新闻资讯7

17万白领岗消失!Scale AI最新研究:AI仅动用了3%实力

新智元报道,近期多家巨头裁员17万,AI成“罪魁祸首”。但Scale AI和Center for AI Safety研究指出,全球六大顶尖AI自动化率不到3%,新基准RLI评估显示其执行有经济价值项目能力有限。

新智元
产品应用7

自主金融研究智能体

Dexter是自主金融研究智能体,会思考、计划和学习。它能将复杂金融问题转化为研究计划,利用实时数据执行任务、自我验证。介绍了其核心能力、安装使用方法、架构、项目结构、配置等。

GitHubStore
推荐文章8

重磅!翁荔最新Scaling Law深度洞察来了

北大毕业的前OpenAI高管翁荔(Lilian Weng)的《Scaling Laws, Carefully》值得一读。Scaling law是预训练预算表,能帮少烧错钱。文章探讨大模型训练预算分配,分析Kaplan和Chinchilla结论差异及数据稀缺问题。

PaperAgent
开源动态8

小钢炮开源,一张3090两小时「从零训练0.1B全模态模型」,模型训练彻底平民化

MiniMind - O是开源超轻量级端到端全模态大模型,采用双轨架构。仅需一张RTX 3090,2小时就能从零训练全链路。有两套训练数据,具备零样本声音克隆等特点,实现大模型训练平民化。

开源AI项目落地
算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心