数据价值验证」共找到 3706 篇相关文章

开源动态8

成本不到8千美元!新浪微博1.5B小模型超越近万亿参数模型

新浪微博开源的VibeThinker - 1.5B模型,仅15亿参数、训练成本不足8000美元,却在顶级数学竞赛基准击败近万亿参数模型。它采用频谱到信号原则,分两阶段训练,性能出色,成本低且数据无污染。

AIGC开放社区
开源动态7

超强开源OCR,手写体识别能力超dots.ocr,封存多年的老文档数字化有救了。

文章推荐新开源的OCR系统Chandra,它对手写体识别做了优化,官方测评数据显示比dots.ocr强。介绍其适用于多场景及功能特点,还展示了不同场景的识别效果,建议有需求者多对比测试。

开源AI项目落地
新闻资讯8

半年赚2亿,400亿市值,它是又一个“寒武纪”?

高端光芯片长期被海外垄断,源杰科技在技术隐士张欣刚带领下实现突破。其25G激光器芯片通过验证,后多款芯片量产,2025年上半年业绩与股价双涨,市值超400亿,还布局美国生产基地。

芯师爷
算法论文8

让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品

斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。

量子位
新闻资讯7

Anthropic 发布最新研究:LLM 展现初步自省迹象

Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。

AGI Hunt
新闻资讯7

马斯克Grokipedia刚上线就「翻车」?被指照抄维基,中文支持一塌糊涂

马斯克预热数月的开源百科平台 Grokipedia 刚上线就遭质疑。它挑战维基百科,强调准确中立,但被指照抄且有偏见,中文支持差,目前文章数量与维基差距大,不过编辑模式也有其价值

机器之心
产品应用7

Excel新AI插件!华尔街「表哥表姐」对手来了

Anthropic让Claude以插件形态接入Excel,可操作和读取数据、定位单元格内容并说明修改理由。还针对金融领域新增6项技能。Claude已被金融企业广泛使用,或取代金融从业者制表技巧,但核算准确性存疑。

新智元
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文化遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型在文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
产品应用7

Sora 2干翻Veo 3?超全对比实测:会中文脱口秀,但体操翻车,附有效邀请码

OpenAI推出Sora2,可生成20秒1080p视频,在物理准确性等方面更优,还具备音画同步能力。文章对Sora2和谷歌Veo3进行多轮对比实测,涉及不同场景,也提及Sora2版权保护及App相关情况。

机器之心
算法论文8

T2R-Bench发布:业内首个由表格生成报告工业基准

为解决大语言模型将表格信息转化为报告的难题,研究团队提出“表格到报告”任务,构建双语基准T2R - bench,其涵盖多垂域表格,还设计评价指标体系,实验显示大模型在该基准上提升空间大。

CourseAI