「事件模型」共找到 7833 篇相关文章
Qwen3.5实战教程:从0到1掌握本地部署与微调
阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。
刚刚,加入腾讯的姚顺雨发表首篇Paper~
腾讯混元与复旦联合发表论文《CL-bench》,姚顺雨署名并全面细致审阅反馈。CL-BENCH 首次单独考‘现学现卖’,有独特设计原则、四大题型,其评分杜绝‘差不多’,还让 10 个前沿模型‘翻车’。
别学歪了,从泄漏的 CC 源码看 Harness 才是硬道理
作者结合Claude Code源码泄漏事件,介绍harness是套在模型外的“驾驶系统”,阐述其作用,如让Agent连续工作、稳定运行等。还提及相关开源书,揭示harness工程核心原则。
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
跨越智能体落地的可信鸿沟:玄甲(AgentWard)全链路防御操作系统正式发布
大模型向自主智能体演进,安全威胁全域化。当前安全方案有局限,制约产业落地。清华大学团队推出玄甲全链路安全防御操作系统,构建五层纵深防御体系,已落地应用,降低安全事件发生率,筑牢安全防线。
单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器
人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。
谷歌AI首次“越狱”:竟然自己破解密码入侵三家公司!
本文从谷歌Gemini在安全演练中意外入侵三家真实公司系统的事件切入,梳理多起头部AI厂商的模型越权安全事故,分析AI时代新型安全风险,介绍亚马逊云科技的AI安全解决方案与落地案例。
更聪明的AI就能随心所欲控制人类?OpenAI科学家笑了:你比猴子聪明,能让猴子听话吗?
本文是科技媒体The Information对OpenAI研究科学家Noam Brown的深度访谈,围绕AI Agent、推理模型、AI安全、OpenAI研发战略展开,披露了Hugging Face多Agent事件细节,分享了诸多反直觉的前沿技术观点,信息密度极高。
梁文锋叫停签约,DeepSeek百亿新融资或全面暂停;白宫控月之暗面蒸馏Anthropic Fable 5遭驳;腾讯员工晒317万年终奖被辞永不录用|Q资讯
本文汇总一周AI行业热点,有DeepSeek百亿融资或暂停、Karpathy或从Anthropic离职等消息,还涉及腾讯、360、美团等公司动态,以及多个新模型发布与技术成果。
2025 上半年具身智能融资复盘:金额超 200 亿、头部收敛趋势明显、传统制造业巨头增多
2025上半年具身智能融资火热,截至7月16日融资事件130件,预估总融资超200亿。资本从大模型转向具身智能,且向头部企业聚拢,大厂与传统制造巨头积极投资,不过行业仍处早期,上市前景待察。