「架构设计工具」共找到 4460 篇相关文章
刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!
小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。
为什么 DeepSeek 大规模部署很便宜,本地很贵
文章探讨了DeepSeek-V3大规模服务便宜但本地运行贵的原因。指出推理服务存在吞吐量和延迟的权衡,受批处理大小影响。还分析了不同模型需大批次的原因,如专家混合模型、大型管道模型等。
苹果憋一年终超同参数 Qwen 2.5?三行代码即可接入 Apple Intelligence,自曝如何做推理
今年 WWDC 大会上,苹果推出专为增强 Apple Intelligence 功能的语言基座模型,含约 3B 参数紧凑型与基于服务器的混合专家模型。经优化可在苹果芯片高效运行,改进工具使用与推理能力,评测显示设备端模型表现优。
AI Agents和Agentic AI有什么区别?
论文《AI Agents vs. Agentic AI》深入探讨AI Agent和Agentic AI的本质差异。AI Agents是集成大模型和外部工具的单体系统,适合简单任务;Agentic AI是多智能体协作新范式,适合复杂场景。还提及挑战、解决方案与未来方向。
先进封装技术解读 | 三星
集成电路产业分芯片设计、制造、封装测试三大领域,先进封装让制造与封测融合。本文解读三星先进封装技术,分2.5D的I - Cube和3DIC的X - Cube,还与台积电、英特尔技术对比,指出三星多为跟随者。
NUS Show Lab 寿政教授:打通自回归与离散扩散,打造下一代具身大模型底座|ECCV 2026
本文整理自新加坡国立大学Show Lab负责人寿政教授在ECCV 2026的分享,团队研发融合自回归与离散扩散的Show-o/Show-2统一架构,解决多模态理解与生成融合痛点,延伸至具身智能领域,突破数据稀缺、推理延迟等核心瓶颈。
企业微信给AI写了94份说明书,Claude Code现在能直接干活
北京时间8月17日,企业微信更新,将能力域从7个扩到12个,参考文档扩到94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。
一夜告别Token账单!端侧AGI真来了
2026年5月19日联想举办新品发布会,全球首发基于此芯Agentic SoC P1的联想AI主机P7与mini。P7小巧低功耗,算力强,有「一机双模」设计;mini更亲民。此芯P1构建端侧AGI算力矩阵,助力端侧AGI成现实。
百度智能云 DuMate 测评:办公 Agent 教我用 Claude Code,效果如何?
百度智能云桌面级AI智能体DuMate于今年3月22日全量上线。本文对其进行测评,设计围绕GitHub项目的复杂任务,测试它在研究、整理、文件生成和展示化输出的表现,探讨办公Agent从内容提供商到办公搭子的转变。
马斯克收购 Cursor,估值从 25 亿到 600 亿只用了 15 个月,最好终局
2026年4月21日,SpaceX宣布与AI编程工具明星公司Cursor达成战略合作,获以600亿美元收购选择权,若不行使需付100亿美元“合作费”。Cursor 15个月估值膨胀24倍,马斯克收购或为补齐短板、引入人才及助力IPO。