「可迁移模型」共找到 10005 篇相关文章
Physical Intelligence 核心技术团队分享:物理世界的“Vibe Coding”如何实现?
Physical Intelligence 核心技术团队解读机器人技术路径,分享前沿探索。介绍 VLA 与 VLM、LLM 关系,还提及 PI 构建数据管线、提出“知识绝缘”机制,分析开放世界部署难题,展望未来“机器人模型即服务”。
国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC
WAIC世界人工智能大会上,国产黑马RockAI的大模型Yan 2.0 Preview亮相,可多终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和多模态能力,引发关注。
The Batch: 839 | 好莱坞加入 AI 版权之争
好莱坞电影公司加入对用其版权作品训练AI模型公司的抗争。迪士尼和环球起诉Midjourney,指控其未经授权用版权作品训练模型、分发含其角色图像,请求停侵权并索赔,版权法相关界定尚不明确。
Cursor 慌了:当 AI 不再需要代码编辑器
Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。
iPhone本地跑Gemma 4火了,0 token时代还有多远?
谷歌开源新模型Gemma 4,部分小型号可在手机端本地运行,速度惊人,还有128k上下文窗口。但在处理复杂任务时表现欠佳。未来端侧模型有望蚕食云端高频简单任务,将冲击现有AI商业模式。
0人工参与实现梯度更新!MIT新框架让AI自动生成微调数据,权重自主升级
MIT提出新强化学习框架SEAL,可让模型生成微调数据和自我更新指令,实现权重更新。无需人工,模型能自动梯度更新。经知识注入和小样本学习实验验证效果,还介绍了其双循环工作机制。
Mistral AI发布一站式编程助手Mistral Code
法国开源大模型平台Mistral AI发布一站式编程助手Mistral Code,旨在解决企业开发人员使用AI编码工具时的合规与安全障碍。它基于Continue开发,集成四个大模型,还能在私有代码库微调,获早期客户认可。
记录下SGLang 开发,debug的几个技巧第二弹
作者BBuf继上次分享后,又带来SGLang开发、debug新技巧。包括开启多线程加载模型权重,介绍SGLang Serve模型短期和长期崩溃的调试方法,还提及逐层NVTX Profiling、查看固定batch_size下Decoding性能等技巧。
Altman 投的 Agent 终端 Warp 开源了,15小时Star 数飙到3.5万!开源是延长软件寿命的最佳方式
由 Sam Altman 支持的现代终端 Warp 正式在 GitHub 开源,OpenAI 成新代码库创始赞助商。Warp 团队认为传统开发模式遇瓶颈,开源可汇集全球创意,还在功能上开放,引发社区热议。
618想换电脑跑AI?先听我一句劝。
文章围绕618换电脑跑AI展开,分析了本地跑AI的情况,包括不同模型对算力和显存的要求,指出本地跑的好处是隐私安全、无限免费,还推荐了不同预算的笔记本,为想换电脑学AI的人提供参考。