「单一厂商锁定」共找到 348 篇相关文章
强化学习 AI 系统的设计实现及未来发展
本文是阿里巴巴算法专家曹宇在AICon 2025北京站的分享。从RLHF系统出发,结合实践展示RL系统现状与发展,探讨超大规模RL方向,涉及理论、业界实践、开源生态等,还介绍了AICon北京站活动。
为什么Claude Code 如此好?「以及如何在自己工作流中复刻Claude Code体验」
本文分析Claude Code好用的原因及如何复刻其体验。作者抓包分析其请求后给出要点,如可调试性优先、保持单一循环、LLM搜索优于RAG等,还阐述控制循环、提示词、工具等设计方法。
AI圈水太深:OpenAI保密、Meta作弊!国产MoE却异军突起
文章梳理大语言模型发展,从传统稠密架构到稀疏MoE架构,参数从百亿到万亿。介绍OpenAI、Meta等厂商模型,如GPT系列、Llama系列,还提及Mixtral、DeepSeek V3等。指出Meta作弊丑闻,国产MoE模型异军突起。
全模态RAG突破文本局限,港大构建跨模态一体化系统
香港大学黄超教授团队开源多模态智能处理系统RAG - Anything,突破传统RAG技术单一文本局限,整合多模态文档解析等核心能力,解决现有RAG系统痛点,具备多方面技术亮点,有便捷部署方式和多场景应用模式。
撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍
J - Space Cognition Suite社区项目在X上传播,称不修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。
年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常
这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。
GPT-Image-2平替!最强开源生图模型来了
OpenAI推出GPT Image 2引发AI生图大战,国内厂商商汤反击,推出多模态理解生成模型SenseNova U1并全面开源。它通过自研架构实现理解、推理、生成统一,实测表现惊艳,能力全维度,与GPT-Image-2范式不同。
AI的窗口期还剩多久,不同窗口处于什么阶段?战略上车来得及吗
文章指出AI窗口期并非单一窗口,而是一组接力出现的窗口。分析了基础设施投资、AI人才、AI应用创业等五个维度的窗口期阶段,给出识别窗口期的框架,还为普通人抓住窗口期提供了实操策略。
Agent搜索哪家强?人大高瓴&快手联合发布全新评测基准GISA
人大高瓴与快手联合发布全新评测基准GISA,用于评估智能体搜索能力。它解决了现有基准反向构造、评估维度单一、答案易被记忆等问题,含373个高质量查询,实验显示当前搜索智能体距人类水平差距大。
一口气集齐老黄苏妈英特尔,还得是AI,还得是联想
CES 2026上,各大厂商行动显示所有设备将成AI设备,有「物理AI」等新趋势。联想集团杨元庆提出混合AI是推动AI普及的终极路径,联想还发布相关产品,展现其在AI生态的优势。