多平台体验」共找到 5548 篇相关文章

算法论文7

只要科学任务能打分,AI就能实现SOTA结果 | 谷歌最新论文

谷歌最新论文提出,只要科学任务可评分,用大模型+树搜索,让AI大海捞针,就能找到超越人类专家的方法实现SOTA结果。他们开发的AI系统在领域发明新方法,都达SOTA水平。

量子位
算法论文7

无需外部数据!AI自问自答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct任务准确率。

量子位
新闻资讯8

刚刚,扎克伯格宣布成立Meta超级智能新实验室

Meta宣布进入超级智能赛道,扎克伯格成立Meta超级智能实验室,任命前Scale AI CEO为首席AI官。MSL整合团队,Meta还投资Scale AI,为抢人才不惜重金,新团队成员来自顶尖实验室,Meta有独特优势。

AGI Hunt
算法论文7

Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent
算法论文8

ICML 2025 | 无需训练,即时对齐大模型偏好

上海人工智能实验室提出TPO方案,可让大模型在推理时快速对齐人类偏好,无需更新模型权重。TPO类似文本形式的梯度下降,在个基准数据集评测中表现出色,还提供“宽深结合”推理拓展策略。

深度学习自然语言处理
产品应用7

Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒重来?

Cherry Studio最初是为用户在不同大模型间切换的聊天客户端,随行业从Chat转向Agent,它开启2.0版本重构,定位转向「个人Agent平台」,底层架构重写,要解决产品复杂性、完善协作等问题。

Founder Park
产品应用7

对话 Funloom AI吴同:拆了AI还能玩,算什么AI原生游戏?

本文对话Funloom AI吴同,探讨AI游戏现状与发展。以《青椒模拟器》为例,指出AI游戏潜力。介绍Funloom平台,能让用户轻松生成文字游戏,分析其与开源项目差异、商业模式及对AI原生游戏看法。

AI科技评论
产品应用7

字节的 Doubao Seed 2.0 来袭,不过我想先和你聊聊扣子编程

作者介绍了AI Coding进展超预期,普通人协作就能做出实用作品。重点讲了扣子编程,它是云端Coding Agent,适合小白,接入个大模型。还介绍了Doubao Seed 2.0升级,最后探讨了编程趋势。

MacTalk
算法论文8

深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析

近日,清华等机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。

AI科技评论
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布大模型版类GAN训练法

康奈尔大学团队提出面向大语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心