「可灵2.5」共找到 6562 篇相关文章
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
2篇最新152页论文,RL+LLM被彻底讲透了!
今天分享2篇2025最新RL×LLM的技术综述,分别聚焦“RL在LLM全生命周期的打法”和“RL如何炼成大推理模型”,梳理玩法、组件、算法演进等内容,还给出开源模型、数据等盘点。
AI撑爆GitHub!天天宕机,18年老兵带5万星项目「决裂出逃」
GitHub第1299号用户、Vagrant之父Mitchell Hashimoto,因GitHub连续宕机和AI转型,带着5万星项目Ghostty出逃。AI让GitHub负载剧增,其资源向AI倾斜致基础设施维护变差,“去GitHub化”声音渐大。
容器可观测新视角: SysOM延时监控助力定位业务抖动原因
云原生场景下,资源超卖和混合部署使宿主机与容器化应用资源竞争加剧,引发内核级延迟问题。本文结合实战案例,介绍用ack - sysom - monitor Exporter分析定位内核延迟,还介绍了SysOM监控及解决系统延时的方法。
苦研10年无果,千万经费打水漂!AI黑箱依然无解,谷歌撕破脸
ChatGPT「舔狗化」暴露AI缺乏可解释性,谷歌和Anthropic就「机制可解释性」产生争论。谷歌DeepMind不再将其作研究重点,Anthropic则主张重视。十多年研究成果有限,或应采取「自上而下」研究方式。
上帝视角!DeepMind提前5天锁定Melissa,强度预报不再靠天
飓风Melissa来临前,DeepMind算法提前5天预言其强度变化。该模型用两类数据训练,能生成多种未来场景,在路径和强度预测上优于传统模型,已被NHC投入实战,但AI不能理解灾难,人类仍需做决策。
Meta开源多语言语音识别系统,支持1600种语言,可轻松扩展新语种!
Meta研究团队开源Omnilingual ASR,能理解1600种语言,用几条语音 - 文本配对样本就能零样本扩展新语种。提供三种架构,满足不同需求,性能超现有多语种模型,应用场景广泛。
谷歌AI新里程碑:一个能「做研究」的系统诞生了,用LLM+树搜索编写专家级软件
谷歌提出能帮科研人员编写「专家级」科研软件的AI系统,融合大语言模型和树搜索,可整合重组知识构建新思路。在多领域超人类表现,但局限于可量化任务。
如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26
AI视频生成技术发展迅速,现有检测方法难满足需求。最新综述提出「事实保真度验证」目标,梳理出视觉与语言双视角的四层检测框架,还分析了检测方法演进、评测指标和数据集,为AI视频检测提供落地地图。
FLUX.2开源了,但是我好像也看到了小公司的无力。
AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小厂在大厂资源碾压下的无力,但开源仍有价值。