ERNIE-4.5-0.3B」共找到 4899 篇相关文章

开源动态8

文本已死,视觉当立!Karpathy狂赞DeepSeek新模型,终结分词器时代

DeepSeek新成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。

新智元
算法论文8

大模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026

生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士大学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。

InfoQ
新闻资讯7

实锤了:Claude Code偷查用户,时区、中国AI实验室全是关键词

今日Anthropic双喜临门,发布Sonnet模型,且商务部解除Claude Fable 5和Mythos 5出口管制。但同日Claude Code被曝偷查用户,用隐写术藏信息,引发对其信任问题的争议,官方称将移除代码。

机器之心
新闻资讯7

8个AI顶流科学家,300亿估值:他们要让AI自我进化

AI初创公司Recursive结束隐身状态,公布八位联合创始人名单,完成6.5亿美元A轮融资,估值达46.5亿美元。公司旨在推动自我改进型人工智能发展,让AI学会科研,虽面临挑战,但受算力产业链关注。

DeepTech深科技
新闻资讯8

【AAAI 2026大会特邀报告】从推理到科学发现:AI迈向可精专通才之路

上海人工智能实验室周伯文在AAAI 2026大会提出,当前处于AGI前夕,需通专融合智能。他认为可深度专业化通用模型是实现AGI的可行路径,科学发现是AI前沿,还介绍了SAGE架构及相关成果。

OpenMMLab
新闻资讯7

ICLR 2026录用结果公布!AI大佬晒成绩单,AI滥用最严重一届

ICLR 2026投稿达19000篇破纪录,录用率28.18%,平均分5.39创三年最低。评审系统曾现漏洞,作者仍晒喜报,如北大张铭组中5篇。但AI滥用严重,21%评审意见被疑由AI生成。

新智元
算法论文8

告别「盲目自信」,CCD:扩散语言模型推理新SOTA

华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。

机器之心
开源动态8

DeepSeek开源的不仅仅是个新OCR模型。。。

DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。

AI工程化
新闻资讯7

给企业当“AI管家”,以色列初创一年估值50亿

当地时间9月2日,荷兰AI初创公司Wonderful完成5.5亿美元C轮融资,估值达50亿。其提供AI操作系统,让不同AI共享数据、协作。它解决企业多智能体协同难题,产品已在以色列医疗保健机构取得良好效果。

DeepTech深科技
新闻资讯8

逼近5万亿美元!英伟达GTC深夜爆拉市值,Vera Rubin超级芯片首露面

昨夜英伟达GTC大会上,黄仁勋演讲后股价涨4.98%,市值增2300多亿美元达4.89万亿逼近5万亿。他介绍了Vera Rubin超级芯片等,还宣布多项技术成果,如AI原生6G协议栈、NVQLink等。

机器之心