DeepSeek-V3.2-Exp」共找到 3880 篇相关文章

新闻资讯8

Llama 4造假丑闻幕后:小扎豪赌143亿,却为中国AI「做了嫁衣」

Meta的Llama 4评测性能造假,OpenAI算力计划引恐慌,全球AI发展陷入困境。中国AI力量爆发,如DeepSeek、MiniMax等,以强大性能、高性价比和商业可持续性满足全球需求,在国际舞台崭露头角。

新智元
算法论文8

Meta打碎Transformer 8年铁律!改写AI最底层规则,模型首次冒出潜意识

Meta推出「自由Transformer」新模型,打破自2017年以来GPT模型核心规则,在解码器引入潜在随机变量Z,增加“潜意识”。仅增约3%计算开销,在多测试中超越大规模模型,或开启后自回归时代。

新智元
新闻资讯7

Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求

Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。

InfoQ
新闻资讯7

重磅!Telegram官宣Grok将登陆!Ton应声暴涨16%

Telegram创始人宣布与xAI达成1年合作,将Grok AI集成到应用中,今年夏天用户可使用。Telegram获3亿现金加股权及50%订阅分成,此合作改写聊天应用格局,也引发用户不同反应。

AGI Hunt
产品应用8

Google I/O 2026 | 开发者主题演讲精华集锦

在今年 Google I/O 大会上,谷歌发布 Gemini 3.5 系列模型,升级 '智能体优先' 开发平台 Antigravity,展示新工具和技能,助力开发者构建应用,还介绍了多项新技术及功能,另有招募活动。

AIGC开放社区
算法论文8

盘一盘,2017年Transformer之后,LLM领域的重要论文

本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构的论文成现代AI基石;介绍GPT - 3的论文确立‘大模型 + 大数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。

机器之心
产品应用7

一键搞定百万行Excel和PPT排版!这家杭州电力AI初创要给打工人减负

AI生产力革命被困云端,本地智能体工作台XMO - AgentBox应运而生。它由杭州曦谋决策打造,集成DeepSeek模型,能处理复杂场景,有平台化能力、核心价值,适合专业人士,现可免费下载桌面版。

量子位
新闻资讯8

马斯克狂烧14万亿,5000万H100算力五年上线!终极爆冲数十亿

马斯克宣布5年内实现5000万张H100的算力,成本超2万亿美元。他已有Colossus超算集群,Grok系列模型也展现强大实力。目前Colossus 2在分批落地,供电采取多元化措施。

新智元
新闻资讯7

端侧AI加速到来,个人隐私如何保护?

Deepseek推动端侧AI加速落地,苹果、谷歌等企业纷纷布局。不过,端侧AI在发展中面临融合不佳、数据安全等问题。阿里研究院傅宏宇提出保障数据安全的建议,监管层也出台相关法规。

芯师爷
新闻资讯7

天塌了,Claude 全面断供Windsurf!CEO喊冤控诉也挡不住开发者退订,祸起OpenAI收购?

当地时间6月4日,Anthropic切断Windsurf几乎所有Claude 3.x模型访问权限。此前Anthropic就拒绝为Windsurf提供Claude 4系列模型支持。有观点认为这与OpenAI收购Windsurf有关,但双方未承认。

InfoQ