「国产AI大模型」共找到 13784 篇相关文章
Vibe Coding两年盘点:Windsurf已死、Cursor估值百亿,AI Coding的下一步怎么走?
文章回顾2023年初到2025年中AI Coding发展,涉及Cursor、Codeium等产品轨迹。指出极端‘坏用户’使商业模式崩塌,需平衡‘交付质量’与‘token成本’,还提及‘Knowledge Suggestion’功能及目标用户选择。
数据减少超千倍,500 美金就可训练一流视频模型,港城、华为Pusa来了
香港城市大学与华为香港研究所合作推出 Pusa 项目,它基于 FVDM 理论,可极低成本微调大规模预训练视频模型,成本降超 200 倍、数据减少超 2500 倍,代码已开源。
视频扩散模型新突破!清华腾讯联合实现高保真3D生成,告别多视图依赖
清华大学联合腾讯提出Scene Splatter,基于视频扩散模型,从动量视角引导其生成满足三维一致性的视频片段,提升三维场景生成效果,解决了传统方法在单张图片重建三维场景的难题。
Skill Factory:三天手搓面向Harness设计的技能工厂(附AI coding实践)
作者分享从产品设计到算法落地全流程实践,指出当前做skill两种方式的问题,介绍面向Harness设计的技能工厂,包括生产模式、生态适配、迭代方向,还提及AI coding实践及各工具作用。
阿里开启 Token 战略,喊出云+AI 年收入破千亿口号,底气从哪来?
3月19日晚,阿里在财报电话会提出未来五年云与AI商业化年收入破1000亿美元目标。过去三月,阿里云Token消耗涨6倍,自研芯片交付47万片,还提价。其正从‘用户红利’转向‘Token经济’,有望‘量价齐升’。
让 AI 自己打怪升级,Meta用Self-play RL把Coding推向超级智能
Meta FAIR、Meta TBD Lab等朝着“超级智能软件工程Agent”迈出第一步。SSR让大模型零人类标注,靠自生成Bug和自修复稳定碾压人类数据基线,新旧范式对比优势明显,还介绍方法、实验结果与理论洞察。
这些关于研发提效的深度实践,值得每一位开发者关注 | AICon
6月27 - 28日AICon北京站上,一线大厂技术大牛将分享“AI赋能研发提效”经验,涉及AI编程范式革新、代码智能化落地、研发流程优化等多方面,呈现技术演进与落地路径。
以星为舵:LLM的Post-Train与Rest-Time奖励学习综述
这篇论文提出奖励信号像AI的“导航星”,引导模型优化行为。介绍奖励学习概念、来源、形式和策略,阐述其贯穿LLM生命周期的三个阶段,探讨奖励模型设计选择,还提及实际应用、挑战与未来方向。
7000亿豪赌,扎克伯格买了众叛亲离
为拿下AI船票,扎克伯格让Meta猛踩油门,投入数百亿参与竞赛,还多次重组AI部门。但他的强硬作风使Meta内部混乱,老将出走,新人不满。Meta虽有新模型计划,可商业模式不明,还面临伦理风险。
揭秘存储超级周期下的机遇与挑战
随着AI算力需求爆发与存储行业超级周期开启,存储芯片价格飙升,引发全产业链连锁反应。这源于AI需求引发的结构性供需失衡,涨价将持续至2026年,还推动半导体产业结构升级。