人在循环中」共找到 8762 篇相关文章

新闻资讯7

上半年谁闷声赚钱?一文看懂芯片七板块

据财联社8月26日披露,截至8月25日,科创板39家公司业绩增幅超100%,集成电路表现突出。芯师爷按芯片设计、半导体设备等七大板块,盘点各板块企业上半年业绩,指出高增集中部分领域,其余环节蓄力。

芯师爷
算法论文8

不靠英伟达,中科院国产 GPU 上跑通 76B 类脑大模型

过去大模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑大模型SpikingBrain,超长文本处理上百倍加速,国产MetaX GPU平台稳定训练76B模型,开辟新道路。

AI科技评论
开源动态8

超级麦吉:职场 Vibe Working 的开源 LLM OS

文章介绍了开源项目超级麦吉,它是为职场打造的 LLM OS,采用三层结构设计,有专业功能和完整产品矩阵。与闭源软件对比,其开源诚意足,虽有颜色和邀请码机制等小问题,但助力职场向 Vibe Worker 转型。

AGI Hunt
8

困住医疗AI的死循环,终于有国产玩家跑通了

文章指出医疗AI行业因数据、模型、场景闭环断裂陷入困境,整体渗透率低。讯飞医疗的星火医疗大模型V3.5评测和临床落地表现出色,其构建自强化循环体系,跑通死循环,或使行业马太效应渐显。

量子位
算法论文8

RLPT:腾讯混元预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是预训练数据上应用强化学习的方法,可突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需工标注,Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
推荐文章7

软件工程中,对 AI 的过度依赖,会加速工程师的无能

资深软件工程师Doug Slater指出,软件工程中对大语言模型(LLM)过度依赖会加速工程师无能。LLM无法取代类批判性思维,它输出、输入、开发速度和用户技能等方面存风险,且无法掌握程序理论和抵抗程序熵。

宝玉AI
新闻资讯8

AI转型最大的门槛,不是技术,是

浪潮信息董事长彭震工智能+生态大会上提出,AI转型最大门槛是而非技术。他指出组织力不足影响业务效果,提出Humagent概念。浪潮信息还从文化、组织、流程层面推动转型,愿做客户同行者。

量子位
算法论文8

让大模型学会“像一样”查证真伪

伊利诺伊大学香槟分校等校研究团队提出训练框架Veri - R1,为大模型提供“线查证”新范式。它借助线强化学习、精细化奖励机制和高质量数据,让模型学会像一样查证,多数据集上表现出色。

深度学习自然语言处理
推荐文章7

刚刚,Thinking Machines Lab博客提出策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《策略蒸馏》博客,提出策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。

机器之心
算法论文8

刚刚,OpenAI找到控制AI善恶的开关:ChatGPT坏预训练阶段已成型

OpenAI最新论文揭示控制AI“善恶”开关。研究发现训练模型某领域答错题,会致其其他领域“学坏”,还找到“毒性格特征”。同时给出解决办法,能让模型恢复正常。

量子位