多选题评测」共找到 4570 篇相关文章

开源动态7

WhisperLiveKit:本地同步实时语音转文字

实时语音转文字难题待解,现有方案各有缺陷。WhisperLiveKit项目用前沿同步语音技术解决问题,支持语言同步翻译、实时说话人识别等,还介绍了安装、部署方式,不过效果受语言和模型等因素影响。

AI工程化
开源动态8

开源!强效果,高性能,严隐私?我全都要:OPPO 终端大模型实践

OPPO AI 中心推出开源端侧模态大模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经阶段训练,OPPO 还构建端侧部署方案,评测显示其在方面表现优异,未来会继续技术革新。

InfoQ
算法论文7

只要科学任务能打分,AI就能实现SOTA结果 | 谷歌最新论文

谷歌最新论文提出,只要科学任务可评分,用大模型+树搜索,让AI大海捞针,就能找到超越人类专家的方法实现SOTA结果。他们开发的AI系统在领域发明新方法,都达SOTA水平。

量子位
算法论文7

无需外部数据!AI自问自答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct任务准确率。

量子位
新闻资讯8

刚刚,扎克伯格宣布成立Meta超级智能新实验室

Meta宣布进入超级智能赛道,扎克伯格成立Meta超级智能实验室,任命前Scale AI CEO为首席AI官。MSL整合团队,Meta还投资Scale AI,为抢人才不惜重金,新团队成员来自顶尖实验室,Meta有独特优势。

AGI Hunt
算法论文7

Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent
新闻资讯7

GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!

第三方评测机构Roboflow测试显示,GPT-5.6 Sol在目标检测、计数等视觉任务上表现出色,尤其在文档版面识别和密集场景处理上进步明显,但认字能力有退步,且大尺寸图片检测框易飘移。

新智元
产品应用7

字节的 Doubao Seed 2.0 来袭,不过我想先和你聊聊扣子编程

作者介绍了AI Coding进展超预期,普通人协作就能做出实用作品。重点讲了扣子编程,它是云端Coding Agent,适合小白,接入个大模型。还介绍了Doubao Seed 2.0升级,最后探讨了编程趋势。

MacTalk
算法论文8

深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析

近日,清华等机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。

AI科技评论
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布大模型版类GAN训练法

康奈尔大学团队提出面向大语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心