多视角评估」共找到 4728 篇相关文章

开源动态8

18.2K Star!macOS 丝滑跑Linux,一键容器、架构支持,开发效率直接起飞!

介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持架构与驱动,有开箱即用的容器化支持等特性,安装和使用简单。

开源先锋
推荐文章7

Kotlin Multiplatform 评估:跨平台开发中的优势与权衡

文章评估了 Kotlin Multiplatform(KMP)在跨平台开发中的优劣势。KMP 可共享代码,编译成原生代码获出色性能,保留原生 UI 选项。虽生态小、有学习曲线等问题,但 Netflix 等大公司已用,未来潜力大。

InfoQ
算法论文8

工行x上交大发布智能体研究成果,通过群体智能刷新翻译新高度!

2025年智能体系统成大模型研发新高地。工行大数据和人工智能实验室与上海交大人工智能学院推出智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
算法论文8

突破单token预测局限!南洋理工首次将token预测引入微调,编程任务准确率提升11.67%

当前主流大语言模型依赖下一token预测训练,难理解跨token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将token预测引入微调,能让模型理解完整概念,领域实验显示其可显著提升模型性能。

量子位
开源动态8

智能体编排太繁琐?MASFactory用Vibe Graphing直接「话」出来了

智能体系统编排当前较为繁琐,北京邮电大学开源 MASFactory 框架,提出以图为中心架构和 Vibe Graphing 开发范式,将开发推向自然语言驱动时代,系统评估显示其效果良好。

PaperAgent
新闻资讯8

微信测试中心刷新业界标准,斩获 ICCV 图像质量评估挑战赛冠军

微信测试中心IH-VQA团队在ICCV 2025 MIPI赛事夺冠,其首创的iDetex方案刷新业界标准。该方案能精准定位图像失真,提升评估可解释性,已在微信业务落地,未来将深耕模态质量评价等领域。

腾讯技术工程
产品应用7

The Batch:831 | 机器翻译正在实践中发挥作用

人工智能为语言学习应用巨头 Duolingo 带来生产力提升,借助生成式 AI 构建 148 门课程,总量翻倍。其 AI 辅助课程构建法能快速转化语种版本,还在评估模型,不过此举也引发批评。

DeeplearningAI
产品应用8

揭秘!腾讯如何训练智能体像专家一样设计游戏场景

腾讯游戏提出游戏场景自动布局生成系统IntelliScene 2.0,利用图像引导生成3D场景。它构建智能体工作流,结合高质量数据集,经模型微调、视觉解析等步骤生成场景,经评估效果良好,为AI生成三维信息提供新路径。

腾讯技术工程
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
推荐文章7

2026年了,我们还在用爱迪生试灯丝的方式评估World Model

文章围绕World model展开深度讨论,界定其概念,分析生成派、JEPA派、空间智能派三条技术路线,指出评估比LLM难,提及游戏化benchmark可能是破局点,还强调具身进展由数据驱动,Ego - View或为泛化关键。

五源资本 5Y Capital