「视频预训练模型」共找到 8621 篇相关文章
2张4090竟能本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了
仅需2 - 4张消费级显卡(4090),就能在本地对DeepSeek 671B乃至Kimi K2 1TB这样的超大模型进行微调。这得益于KTransformers和LLaMA - Factory两个国产明星项目联动,大幅降低成本,开启AI个性化定制时代。
马斯克「世界模拟器」首曝,1天蒸馏人类500年驾驶经验!擎天柱同脑进化
特斯拉官宣「世界模拟器」,可模拟、合成自动驾驶的「孪生世界」,生成不同视角和长尾场景。它基于端到端神经网络,有学习人类价值观等优势。还能用海量数据解决难题,输出可解释中间结果,为自动驾驶和擎天柱训练服务。
Gemini再揽金牌,力压大学学霸,AI数学推理时代来了!
苏黎世联邦理工学院博士生在大学生国际数学竞赛(IMC)测试了Gemini三种模式,其表现远高于金牌门槛,远超普通大学生。研究人员还从模型输出提取见解,展现了Gemini在数学推理上的优势,凸显AI数学推理能力日益强大。
文档OCR新范式0.84 页/秒,吊打MinerU Qwen2.5VL
MonkeyOCR采用SRR三元组范式,简化多工具管道,避免整页文档处理低效率。与MinerU、Gemini 2.5 Pro等对比,性能表现优,处理速度达0.84页/秒,但对扫描件效果欠佳,架构含多模型,可通过特定地址测试。
DeepSeek R1 的小更新,却大有深意?
5月28日,DeepSeek低调宣布R1模型小版本试升级,API接口和使用方式不变,但未公布具体更新内容。从用户反馈看,语义理解、逻辑推理等能力提升,实测表现出色。此次升级或有安全、产品路线等考量。
6个做AI和ML的奇技淫巧
作者整理了6个做AI和ML的技巧,如提前结束评估、超参数过度优化、精心挑选数据集等,指出现在90%的模型可能都用到其中不止一招,还介绍了自己用AI采集资讯发布到知识星球。
时隔六年,OpenAI 为什么再次开源?
OpenAI发布两款开源纯文本推理模型,时隔六年再次开源。其gpt - oss - 120b性能与o4 mini相当,成本降超10倍。此次开源有战略考量,或是为构建生态、吸引企业,也反映出其对自身价值定位更清晰。
GPT-6 Astra 发布了,我却把 GPT 的订阅从 100 刀降到 20
9 月 1 日作者将 Codex 订阅从 100 美元降至 20 美元,两天后 OpenAI 发布 GPT - 6 Astra。作者降级是因大量用 K3、Qwen 3.8 和 GLM5.3 等。Astra 功能强大,但作者仍会让国产模型担主力。
Claude Fable 5怎么用?Anthropic 工程师:干你也不知道的事
Anthropic的Claude Code工程师Thariq Shihipar发长文介绍Fable 5使用方法。他认为与Fable 5协作要发现未知,其定位解决复杂问题。还将未知分类,给出任务前中后打法,并举例用Fable 5剪视频。
少 61% Token、多10倍成功率,这个终端 AI 编程代理火了!
现在多数AI编程工具问题多,而在Github上火爆的`oh-my-pi`是运行在终端的AI编程代理,有哈希锚定编辑等实用功能,支持多模型,经基准测试效果好,还能解决实际开发痛点。