「全云化架构」共找到 3470 篇相关文章
LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型
LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。
Computer Use:莫拉维克悖论
2025年AI在数学证明等“高阶智能”任务表现佳,在“像人类一样使用电脑”任务却受挫,再现莫拉维克悖论。文章分析计算机使用智能体是实现AGI机会与挑战,指出发展难题、探讨RL作用并给出研究方向。
《“人工智能+”行动意见》深度解读:从人口红利到智能红利,中国经济社会变革新引擎
《“人工智能+”行动意见》是全面重塑中国经济、社会与治理体系的国家战略。它以应用促创新,定位AI为新质生产力关键引擎,涉及多领域变革,还采取不对称竞争策略,应对国际博弈。
传言:华为版 DeepSeek R2 本月发布
据 Huawei Central 报道,DeepSeek R2 可能本月 15 至 30 日发布,运行在华为 Ascend 910B 集群,硬件利用率 82%,算力 512 PetaFLOPS FP16,效率达 A100 的 91%,将与 ChatGPT 5 竞争,但消息未证实。
2025年多款Deep Research智能体框架全面对比
文章从 OpenAI 关于 DeepResearch 的指南入手,对多个开源深度研究智能体框架进行架构解构与功能对比,还体验了商业化智能体应用,为使用者和开发者选工具框架提供参考。
监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力
大模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。
The Batch: 855 | 为智能体而生
总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。
狂涨 7.4K star!!一款堪称开源监控新标杆的项目,谷歌、字节都点赞,牛皮!
介绍开源监控工具 Checkmate,它由 BlueWave Labs 开发,主打“自托管 + 全功能 + 易上手”,功能强大、性能卓越、灵活易用,已获 7.4K star,受大厂工程师青睐。还介绍了其功能特色、安装方法。
BLIP3-o统一图像生成与理解,多模态融合趋势显现
BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。
整个硅谷被Meta 1亿美刀年薪砸懵了!Anthropic 联创正面硬刚:团队使命比黄金贵,多少钱都挖不动
Meta为抢AI人才,给出首年超1亿美元、四年封顶3亿美元的天价Offer。但Anthropic联合创始人Benjamin Mann称,团队重使命,钱难挖人。他还警示AI或重塑就业市场,约20%岗位受影响,同时分享AI安全等看法。