「技术预览版」共找到 3382 篇相关文章
Karpathy最新手搓!复现GPT-2成本狂降600倍:仅需507元3小时训练「最好的AI学习项目」
Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成本低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成本降600倍,还列出关键优化技术,设排行榜。
今天的AI基建狂潮,恰如150年前铁路狂潮的历史轮回
文章指出铁路与AI这两场相隔150年的基建狂潮,上演着相同剧本:技术突破引发资本涌入,过度建设致过剩,泡沫破灭后洗牌。回顾美国铁路建设兴衰,类比当下AI投资,给出周期阶段信号及价值转移路径。
告别微调时代:拖拽式LLMs实现12000倍加速适配,输入描述,秒级定制LLM,效果、速度全面超越
传统高效微调技术成大规模部署瓶颈,论文提出Drag-and-Drop LLMs (DnD),仅需输入目标任务未标注提示,即可秒级生成适配的LoRA权重,实现LLM秒级免训练适配,效率、性能和泛化性上均有突破。
一个国产AI视频产品如何吸引全球6000万用户?|甲子光年
文章围绕爱诗科技旗下AI视频产品PixVerse展开,讲述其吸引全球6000万用户的历程。介绍创始人王长虎两次技术路线转型,先做To C再推API,还谈及B端业务场景及‘拍我AI’国内上线等情况。
刚刚,Claude水印一夜变废纸!
今早GitHub上一个去水印神器代码库爆火,狂揽11000颗星。它采用MIT开源协议,能抹除Claude等水印及相关文件鉴权数据。此前Anthropic高调展示水印技术,如今防线被打破,引发开发者对大公司傲慢的反击。
揭秘OpenAI 1.5万亿美元交易内幕:奥特曼核心圈子主导,绕开银行家和律师
OpenAI CEO Sam Altman与内部核心高管圈子主导1.5万亿美元系列交易,绕开银行家和律师。交易呈技术优先、财务后置非传统模式,如与英伟达、AMD等多笔重磅交易,还介绍了绕开外部顾问原因。
4小时喜提专属 ChatGPT、卡帕西又整活!自曝Agent帮倒忙、手搓八千行代码,网友:跑完就当上机器学习工程师
特斯拉前AI总监安德烈·卡帕西发布开源项目nanochat,是极简全流程训练/推理工具链,可搭建简易版ChatGPT复现模型。花100美元最快4小时能训练出可对话模型,代码基本手写,网友热度高。
FlashAttention-4震撼来袭,原生支持Blackwell GPU,英伟达的护城河更深了?
在 Hot Chips 2025 上,TogetherAI 首席科学家 Tri Dao 公布 FlashAttention-4,其在 Backwell 上比英伟达 cuDNN 库中的注意力核实现快 22%,还实现两项算法改进。该技术一直迭代升级,提升了注意力计算效率。
Genie 3,让幻觉持续成为现实
Google最新发布的Genie 3能从文本生成交互式世界,实现24fps实时交互,分钟级一致性,720p分辨率。它取长补短,有出色记忆能力,物理表现自然,还能让智能体完成任务。不过目前是有限预览,有不足。
DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持
Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。