模型能力提升」共找到 9797 篇相关文章

新闻资讯8

Ilya交卷!黄仁勋砸50亿押注SSI,首个模型疑本周发布

Ilya Sutskever创立的SSI或本周发布首个重磅模型,引发圈内关注。英伟达砸50亿美元合作,提升其算力。该模型基于测试时训练架构,能边学边进化,或终结大模型“预训练时代”。

新智元
算法论文8

用大模型检测工业品异常,复旦腾讯优图新算法入选CVPR 2025

AI模型用于工业异常检测获新SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成新模型DualAnoDiff,实验显示其性能更优。

量子位
新闻资讯7

Cursor“自研”模型套壳国产开源?网友:毕竟好用又便宜

美国顶流AI产品Cursor和Windsurf发布新模型,被指“套壳”中国开源大模型。Cursor新模型干活时说中文,Windsurf或用智谱GLM。中国开源模型物美价廉,在榜单和下载量上表现出色。

量子位
产品应用7

为 OpenAI 秘密提供模型测试, OpenRouter 给 LLMs 做了套“网关系统”

OpenRouter成立于2023年初,为用户提供统一API Key调用各类模型,OpenAI会用其秘密测试。平台token用量高速增长,还发布模型用量排行榜引关注。创始人认为大模型非赢家通吃,未来想成agent最佳推理层。

海外独角兽
产品应用8

Agent、图像、视频全是大版本升级:春晚还没开,豆包AI就火了

2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含大模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。

机器之心
新闻资讯8

刚刚,一口气连发3个王炸模型、亮出2026年AGI战略,昆仑万维夯爆了

27日下午,昆仑万维在2026中关村论坛发布全新AI游戏世界模型Matrix - Game 3.0、AI视频大模型SkyReels V4和AI音乐大模型Mureka V9,还公布2026 AGI战略,推动AI从全模态能力突破进入平台化构建阶段。

机器之心
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI
开源动态7

DeepSeek开源新基础模型,但不是V4,而是V3.1-Base

昨晚深度求索宣布DeepSeek线上模型版本升级至V3.1,在Hugging Face发布新模型DeepSeek - V3.1 - Base。该模型是V3系列最新基础模型,发布后冲上Hugging Face热门榜第4位,社交网络看法不一。

机器之心
算法论文8

其实,扩散语言模型在最终解码之前很久,就已确定最终答案

随着扩散语言模型(DLM)发展,它成自回归(AR)模型有力替代。但实际推理慢于 AR 模型。研究者发现早期答案收敛现象,提出 Prophet 策略,实验显示其能在保持高质量生成时显著加速推理。

机器之心
新闻资讯7

OpenAI推理第一人创业了:要造“活到老学到老”的AI,先来融它70个亿

OpenAI推理模型第一人Jerry Tworek离职不到一个月就创业,新公司Core Automation计划筹集10亿美元,要做具备「持续学习」能力的新型AI模型,解决主流模型‘训完就上线’、能力固定的问题。

量子位