「数据性能」共找到 4088 篇相关文章
The Batch: 859 | Qwen3 的自主智能新进展
不到两周前 Kimi K2 超越其他开源非推理模型,如今阿里巴巴发布基于早期 Qwen3 - 235B - A22B 的三款新大语言模型权重,介绍了输入输出规格、架构设计、性能表现、使用方式等,还进行了性能对比。
GLM-5正式发布,744B参数,对标Claude
GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。
推荐:AI搜索增加链接展示,从谷歌people also ask到AI搜索;AI绘画从吉卜力到Nano Banana增长方法论
文章推荐两篇内容。一是Google将在AI模式增加链接展示,访谈提及AI搜索是传统搜索迭代,核心SEO原则仍有效;二是复盘Remini借热点增长的DICE模型,含数据监测、敏捷创新、创意营销和数据验证。
一种基于滑动层合并的高效深度修剪大模型的方法
文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。
名师一定出高徒?清华团队最新揭秘:别再迷信大模型蒸馏的「免费午餐」
当下大模型后训练中,On-Policy Distillation(OPD)成明星技术,业界采用后报告性能提升。但清华团队研究发现,换更强Teacher,Student性能可能无提升甚至倒退。研究揭示蒸馏成败条件,深挖对齐机制,还给出拯救失败蒸馏的方法。
ICLR 2026 Oral|多模态知识图谱对齐难:破解噪声关联至为关键
在数据多元化时代,多模态知识图谱能为下游应用提供数据支撑,实体对齐是构建知识图谱的核心技术。但大规模知识图谱关联与融合面临噪声和潜隐关联挑战。四川大学团队提出 RULE 方法,缓解了这些影响,论文被 ICLR 2026 接收为 Oral。
后AlphaFold时代的冷思考,AI制药的破与立 | GAIR live 028
雷峰网等组织“后AlphaFold时代AI制药的破与立”线上圆桌,三位学者探讨AI制药问题。指出算力难颠覆生命法则,数据有缺陷,还给出赛道选择建议,提及AI Agent重塑科研关系及中国AI制药优势与挑战。
国民技术发布面向AI数据中心的3 kW数字电源参考设计方案
在AI算力增长与能源转型驱动下,电力供给变革。国民技术发布面向AI数据中心的3 kW数字电源参考设计方案NS3KW53V5P2L3,基于N32H474芯片和Hunter OS生态,有高转换效率等优势。
初识App Store和苹果审核【第一期】深度解析
App Store的审核流程和苹果惩罚机制究竟是怎样的?文章详细解析了App Store的变迁、分发模式、开发者账号区别、上架流程、审核流程和依据,以及惩罚机制和应对方式。
狂揽 18.9K star!这款开源、免费、功能超强的物联网 IoT 平台项目,太6了!
物联网技术成行业发展关键,但构建系统挑战大。开源项目ThingsBoard应运而生,提供一站式解决方案,功能强大,如规则引擎、告警管理等,安装部署简单,值得开发者尝试。