自监督模型」共找到 8258 篇相关文章

产品应用8

MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了

面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。

AGI Hunt
新闻资讯8

刚刚,马斯克Grok 4.1低调发布!通用能力碾压其他一切模型

xAI 低调发布 Grok 4.1 并向所有用户开放,可多平台使用。该模型在真实世界可用性上显著提升,尤其在创造力等方面出色。它在多项评估中表现优异,通用能力领先,情感智能、创意写作佳,还降低了事实幻觉。

机器之心
产品应用8

可灵3.0系列模型正式上线:属于每个人的导演时代来临

可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。

AI科技评论
开源动态7

数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~

Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。

PaperAgent
算法论文8

网页藏毒,劫持Agent?你需要会「追凶」的进化女警系统

AI Agent接入外部环境后,易遭遇隐蔽的网页藏毒、prompt注入攻击,传统防御要么成本过高要么易被新型攻击绕过,本文介绍新提出的进化防御系统CAITLYN,验证了其防御效果。

新智元
算法论文8

模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
新闻资讯7

一手奶瓶一手键盘!新手宝妈产假氛围编程,研实用家庭App

新加坡宝妈Laura Zaccaria产假研家庭餐食规划App。她无编程背景,靠Cursor等工具学习。AI迭代快,她意识到要跟上,产假成我进化契机,提醒大家学习才能不被时代抛下。

新智元
算法论文8

AI数学能力暴涨100%,进化直逼RL极限!CMU新作颠覆认知

数据枯竭成AI发展瓶颈,CMU团队提出SRT方法,让LLM我进化,提升数学与推理能力,性能逼近传统强化学习。研究还分析其局限,提出缓解奖励作弊策略及应对模型崩溃的方法。

新智元
开源动态8

利用大模型从开源情报中动提取检测规则:LLMCloudHunter,有开源

随着网络攻击增加,威胁情报成主动安全关键。以色列本古里安大学发布LLMCloudHunter框架,用大模型从开源情报动生成检测规则,评估显示其规则质量高,且大部分能编译成Splunk查询,软件已开源。

AI与安全
产品应用8

击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了

近日,由复旦邱锡鹏担任首席科学家的模思智能发布多说话人动语音识别模型 MOSS - Transcribe - Diarize,性能超 GPT - 4o、Gemini 等。它解决语音领域落地痛点,跑分亮眼,还解决 SATS 方案不足,开放 API 限时免费。

机器之心