「亿嘉和」共找到 6926 篇相关文章
ChatGPT开始预测用户年龄,NSFW内容要来了!
OpenAI于1月20日更新推出年龄预测功能,通过分析用户多方面信息判断是否为18岁以下。网友测试发现猜测较准,这或使NSFW内容限制放宽,不同模型版本情况有别,更新还改进语音和记忆功能。
英伟达发布 Jet-Nemotron 系列小模型,理论最大加速比 56 倍
英伟达发布 Jet - Nemotron 系列小模型,在多项基准测试中表现出色,实现高吞吐量加速和高准确率。其训练采用 PostNAS 方案,对既有模型针对性优化,展示了在小模型优化上的可行技术路径。
硅谷最狠「伪君子」!华人女记者深扒OpenAI:3000亿AI帝国全靠偷数据?
华人女记者郝珂灵深挖OpenAI黑历史,其新书《Empire of AI》引发巨大反响。书中指出OpenAI宣称造福人类,实际是资本机器,其技术发展路径依赖数据和算力,还存在AI让少数人受益、AGI定义模糊等问题。
无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%
西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。
图解Vllm V1系列4:加载模型权重(load_model)
文章聚焦vllm加载模型权重的流程。从入口函数切入,详细分析DefaultModelLoader的工作步骤,包括初始化模型架构和实际加载权重,还给出各步骤代码及作用,为想操作load_model的人提供框架。
准确率轻松翻倍!不烧钱微调,AI靠“写日记”实现能力跃升
Memento - Skills系统抛弃大量算力微调模型参数的方式,靠读写反思、“写日记”式学习机制,在不改变模型参数下实现能力跃升,在GAIA和HLE基准实验中准确率显著提高。
刚刚,OpenClaw登顶GitHub软件星标历史第一!已超越Linux
仅两月,本地AI框架OpenClaw击败Linux,登顶GitHub星标第一。它是开源本地运行的AI Agent框架,能接入通讯工具,虽引发安全危机和限制,却热度不减,反映开源社区趋势变化。
Nature 正刊收录!清华 FIB 实验室揭示:AI 提升科学家个人影响力,却收缩科学整体探索空间
清华大学 FIB 实验室牵头研究表明,AI 在自然科学应用广泛,提升科学家个人影响力,但使科学整体探索空间收缩。研究基于大量论文和人员数据,还提出科研智能体系统 OmniScientist 缓解问题。
QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5
通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。
NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临
传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。