「预发布模型」共找到 9159 篇相关文章

算法论文8

无需验证器的RL:RLPR解锁LLM通用推理潜能

现有依赖强化学习与可验证奖励(RLVR)提升大语言模型(LLM)推理能力的方法,受限于领域特定验证器。本文提出RLPR框架,利用LLM生成正确答案的固有概率作奖励信号,实现无需外部验证器的通用领域强化学习,效果显著。

深度学习自然语言处理
新闻资讯7

离开一手做大的饿了么 6 年后,他带着 7 亿估值的 AI 公司杀回来了

近日,新加坡AI应用开发商Orion Arm获1100万美元A轮融资,投后估值达1亿美元。其创始人是前饿了么联合创始人汪渊,已发布智能日程管理应用Toki AI和资讯工具Syft AI两款产品,目标三年内让用户达1亿。

AI前线
新闻资讯7

今天我替煤炭给AI正个名。。。

一份标价8200元的煤炭研究报告称煤炭是可再生资源,可打怪获取,此事引发热议。很多人认为是AI写的,但报告是2022年出版,那时ChatGPT都未发布,实际是人类所为。AI暴露了行业内假装专业的垃圾内容。

数字生命卡兹克
新闻资讯9

Claude有意识了?科学家首次挖出关键拼图,还能伸手改它的念头

本文报道Anthropic最新研究,团队在Claude大模型中发现自发形成的J-space区域,匹配意识研究的全局工作空间理论,人类可直接读取、修改AI未输出的内部想法,揭示了现有AI对齐评测的重大漏洞,为AI意识研究提供了工程化路径。

新智元
新闻资讯8

刚刚,神话级Fable 5.1来了!

今天,Claude Fable 5.1全平台上线,Mythos 5.1专供特定团队。新模型跑分有断层式代差,还降低了算力门槛。通过重绘金星、设计蛋白等案例展示其科研能力,在编程上也表现出色,同时在安全上采取‘一松一紧’策略。

新智元
算法论文8

破解遥感目标的形状与尺度难题,PKINet二代推理提速近4倍!

PKINet - v2是改进的遥感目标检测模型,能处理复杂形状和尺度变化问题。它在PKINet基础上升级,统一条带与方形卷积,部署时折叠为单大核。在多数据集上精度和速度提升,可服务多领域,但对特殊目标仍有检测问题。

新智元
新闻资讯7

独家 | CMU博士、UCSD助理教授黄碧薇创立「原识之智」,聚焦因果推理方向

AI科技评论独家获悉,CMU博士、UCSD助理教授黄碧薇创立上海原识之智科技有限公司,切入具身智能基础层相关的因果推理方向。当下大语言模型在符号世界表现出色,而机器人缺乏因果推理能力,原识之智项目已获顺为资本早期投资。

AI科技评论
产品应用7

我用“悟空”做了应聘和OPT Skills,预测上班和创业成功率丨龙虾OPT创业笔记

钉钉发布全球首个企业级 Agent 平台“悟空”,它是AI产品进入下一个时代的探索,能接入多平台真实数据,操作公司流程。通过开发者应聘、跨境电商、知识博主等场景案例,展现其能力,还能预测创业成功率,解决企业使用AI的安全痛点。

鲸选AI
新闻资讯7

苹果春季新品奔着龙虾来了!AI性能暴涨8倍,8499元起

苹果发布MacBook Pro M5系列、MacBook Air M5笔记本,8499元起,还更新了显示器。新款MacBook Pro搭载M5 Pro和M5 Max芯片,AI性能大幅提升,提示词处理速度快4倍,图像生成速度快8倍,存储、续航等方面也有优化。

量子位
开源动态8

sgl-kernel MoE Align Block Size Kernel 优化过程解析

文章记录SGLang的sgl-kernel中优化 `moe_align_kernel.cu` 的过程。MoE模型的 `moe_align_block_size` kernel从最初的baseline版本经多次迭代,包括加向量化padding、用Blelloch Scan并行化前缀和、用Warp Scan减少同步开销等。

GiantPandaLLM