「大模型Yan 2.0」共找到 8858 篇相关文章
Agentic RL 后训练资源怎么分?港中文、恒生大学提出 Libra,吞吐最高提升 3 倍
大语言模型走向“完成任务”,Agentic RL 后训练让系统工作负载不稳定。港中文和恒生大学团队提出 Libra 资源管理系统,统一优化训练与 rollout,在多任务中提升吞吐,论文与代码已公开。
Agnes AI 实测:AI 编程真正的瓶颈,99%的人想错了
本文实测Agnes AI,指出AI编程瓶颈在于缓存命中率,而非模型智商。介绍其产品线、评测成绩与价格优势,还分享客户端体验,包括亮点、回滚事故及日志结论,最后点明智能免费后验证更稀缺。
Meshy用户破千万后杀向新战场:ARR年翻14倍,头部厂商集体买单
Meshy是计算机图形学大神胡渊鸣创立的AI 3D公司,其创意工坊打通“AI创意→实体交付”。Meshy生成模型打印适配度高,破圈至多元领域,注册用户破千万,ARR年翻14倍,获多轮融资。
Karpathy强推,大厂抢着「复古」命令行,Star数全都上千了
飞书、钉钉、企业微信接连推出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合大语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。
从 SQL 到自然语言,下一代 Lakehouse 为何必须「AI 优先」
随着大模型技术爆发,数据分析范式重构,未来数据多模态、分析复杂、查询方式转变。文章指出构建下一代 AI-First Lakehouse,要在存储计算、内核能力、架构适配、平台自治等方面升级,打破数据壁垒。
刚刚,英伟达拟10亿美元砸向这家AI编码创企!Copilot 技术大佬带队、成立两年估值近千亿
10月30日消息,英伟达拟向AI初创公司Poolside投资最高10亿美元。该公司由微软技术大佬带队,定位生成式AI与软件开发交叉领域,开发自研模型,有独特强化学习方法和技术布局。
有什么事情是当了程序员之后才知道的?
本文是腾讯程序员分享当程序员后才知道的事,如改一行代码能崩项目、本地部署模型可免费搞定等,还给出多个有趣观点,最后发起评论互动并抽取粉丝送Q币卡。
RL 效率无损飙升 3 倍:厦大-Shopee-清华联合首创,将投机解码首次引入 RL,推理能力稳如初!
传统RLVR训练中,rollout阶段耗时成瓶颈。厦大 - Shopee - 清华联合团队提出SPEC - RL,将投机解码引入RL,训练提速2 - 3倍,避免重复生成,与主流算法兼容,在多项基准测试中性能稳定。
从 AI 3D生成转型AI原生影视公司,Utopai Studios想「稍微」改造下好莱坞
2022年创立的AI 3D生成公司Cybever转型为Utopai Studios,获好莱坞人士投资,还推出两部AI影片计划。其00后掌舵者Cecilia Shen称要变革制作范式,解决AI视频模型瓶颈,解放创作者。
Claude:Profile and Preference
文章借与Claude对话,探讨Profile和Preference概念,分析其区别联系,指出AI时代借助大模型理解用户的变化,还谈及数据源、实时个性化、偶然性、广告变革等问题,最后Claude为作者生成简易画像。