「小模型推理能力」共找到 9427 篇相关文章

新闻资讯8

英伟达,开始限制Claude使用了

本文援引The Information报道,英伟达、Palantir等大企业因对敏感数据控制权的顾虑,限制Anthropic Claude前沿模型用于核心敏感业务,探讨了企业级AI落地的新矛盾与行业发展方向。

机器之心
开源动态7

3.3k星星爆火!Claude Design开源升级版,中文本地化,支持DeepSeek V4

Anthropic发布的Claude Design能生成UI、人机协作,但国内无法使用且不能用自己的API。Open-codesign是其开源本地化平替方案,支持多模型,功能丰富,保密性好。

开源AI项目落地
开源动态8

14.5K!冲上Github Trending榜,字节最新开源Agent上下文"数据库"!

OpenViking是字节跳动火山引擎开源的AI Agent上下文数据库。它用文件系统范式管理上下文,有分层加载、递归检索、可视化轨迹和自动会话管理等特性,支持多种模型,测试效果显著。

GitHubStore
新闻资讯8

硅基生命的「成年礼」:上海具身智能的入世大考与万亿生态突围

2025年,上海具身智能产业发展迅速。政府通过场景开放、算力平权等举措构建生态。智元、傅利叶等企业成果显著。12月12日GDPS大赛是成果检验,各赛道考验机器人不同能力。

AI科技评论
算法论文8

OpenAI、Anthropic、DeepMind联手发文:现有LLM安全防御不堪一击

OpenAI、Anthropic、Google DeepMind 联手发文,研究语言模型安全防御评估。指出现有防御评估有缺陷,提出通用自适应攻击框架,成功绕过 12 种防御机制,多数攻击成功率超 90%。

机器之心
算法论文7

视觉优势还是语义依赖?揭秘 DeepSeek-OCR 高压缩率背后的真相

中科院等团队论文剖析 DeepSeek - OCR,通过实验揭示其高压缩率下准确率高或依赖语言先验。去掉语言先验,准确率暴跌;下游任务推理崩塌,长文本处理也有瓶颈。

深度学习自然语言处理
新闻资讯7

为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告

本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等问题,还会解答观众提问。

AI前线
推荐文章8

上交博士最新思考:仅用两个问题讲清强化学习

上交博士 Kun Lei 博客提出用两个问题理解强化学习:数据从哪来、策略更新多频繁。借此梳理算法逻辑,还延伸到机器人基础模型,指出训练节奏与其实践契合。

AI科技评论
产品应用7

使用 GPT-5 进行编程的六个技巧

OpenAI给出使用GPT - 5编程的6个提示技巧,如指令准确无冲突、选对推理力度、用类XML语法结构化规则等,还提供了详细提示技巧的参考链接。

AI寒武纪
新闻资讯7

刚刚,Anthropic 成立了个 AI精神病学团队,正在招人

Anthropic宣布成立「AI精神病学」团队,作为可解释性研究一部分,将研究模型人格、动机等致其行为异常的因素。团队现正招聘研究科学家,不过此举措也引发争议。

AGI Hunt