新词新站」共找到 3952 篇相关文章

开源动态7

智谱模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
新闻资讯7

5个月估值翻10倍,AI数据赛道跑出一家独角兽

成立约18个月的AI训练数据公司AfterQuery正筹一轮融资,估值达32亿美元,5个月涨超10倍。它最初想开发AI智能体,后转收集训练材料。此赛道已有多家高估值公司,且数据隐私和安全风险待解。

DeepTech深科技
开源动态7

R1一周年,DeepSeek Model 1悄然现身

2025年1月20日,DeepSeek发布DeepSeek - R1开启开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。

机器之心
开源动态8

华为开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革

机器之心
开源动态8

攻克结构化长文档检索难题!框架让模型告别“结构性失明”

SEAL团队推出全对比学习框架SEAL,通过带结构感知和元素对齐,将文档宏观层级结构和微观元素语义融入Embedding空间,提升模型对结构化数据的理解。在BGE - M3模型上提升了MRR@10指标,还开源了万级字数长文档数据集。

量子位
8

刚刚,OpenAI神秘模型斩获IMO 2025金牌!攻克奥数巅峰,硅谷沸腾

OpenAI用全通用推理模型夺下IMO 2025金牌,解出5道题狂揽35分,远超此前Gemini 2.5 Pro的13分。此或意味着其研发出颠覆性推理技术,告别CoT,且模型未针对IMO训练,有持久创造性思维。

新智元
开源动态8

Meta开源史上最强语音“基座模型”:一口气支持1600+种语言

Meta AI FAIR团队发布Omnilingual ASR模型套件,能为超1600种语言提供自动语音识别能力。它引入架构提升性能,改变引入语言范式,还发布相关数据集和模型,与全球伙伴合作。

AI寒武纪
算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
新闻资讯7

100亿美元押注AI:红杉换帅后,寻找“白天鹅”

2026年8月,红杉资本募得约100亿美元。掌舵人林君睿和帕特接受专访,称当下是“白天鹅”市场。此前红杉经历领导层更替,团队调整投资决策,还补仓Anthropic,布局AI多环节。

DeepTech深科技
推荐文章7

Claude Skills 写作指南:从0到1看完就会,不会来找我

本文介绍Claude Skills写作指南,指出传统提示使用麻烦,而Skills能解决问题。阐述其适用场景、定义、原理,还讲了创建方法、作者实践及完整写作工作流,可按需管理提示

AI产品自由