大V」共找到 5426 篇相关文章

算法论文8

跳出「黑盒」,人刘勇团队最新语言模型理论与机理综述

语言模型工程成功但理论研究滞后,被视为「黑盒」。人刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
新闻资讯8

史上首次!米兰冬奥基于阿里千问打造奥运官方模型

2月5日,国际奥委会主席柯丝蒂·考文垂宣布基于阿里千问打造奥运史上首个官方模型,已在赛务与公众服务双端落地。此外,自动媒体描述系统、AIGC技术等也有应用,阿里云多项技术助力米兰冬奥。

千问Qwen
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。

PaperAgent
新闻资讯7

AI模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭

网易有道词典笔产品负责人孟旭在AICon会分享,以有道AI答疑笔为例,阐述智能学习硬件在模型催化下从“学习工具”进化为“智能伙伴”,其发展呈“需求牵引 - 技术支撑 - 体验升级”螺旋路径。

AI前线
算法论文8

文言文秒杀所有模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。

CourseAI
新闻资讯8

DeepSeek低价风暴打服硅谷!海外平台争相倒贴V4 Flash

DeepSeek V4 Flash掀起价格风暴,全球开发者为之疯狂。海外平台如Nous Portal、Cline等纷纷补贴,其能力幅提升,价格却极低,让开发者更愿尝试开源模型,AI应用层或迎转机,且DeepSeek Code可能将至。

量子位
新闻资讯7

DeepSeek不惜代价保住它!V4关键特性被挖出来了

DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。

量子位
算法论文8

模型如何准确读懂图表?微软亚研院教它“看、动手、推理”

多模态模型处理结构化图像有误差放、推理难等问题。微软亚洲研究院等提出PixelCraft,以高保真图像处理与非线性多智能体推理为支柱,提升结构化图像理解性能,在多基准上有增益。

量子位
开源动态8

Karpathy强推,厂抢着「复古」命令行,Star数全都上千了

飞书、钉钉、企业微信接连推出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。

机器之心