大模型技术」共找到 10342 篇相关文章

推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。

PaperAgent
算法论文8

文言文秒杀所有模型!100%攻击成功,轻松突破安全防线

南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。

AIGC开放社区
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型

CourseAI
新闻资讯7

陈天桥重磅出手!20瓦人脑秘籍,AI模型瞬间「破防」

上周六,天桥脑科学研究院创始人雒芊芊宣布成立尖峰智能实验室,由李国齐教授领衔,致力于类脑模型和脉冲神经网络研发。该实验室是‘发现式智能’理念落地载体,将借鉴人脑特性研发类脑模型

新智元
算法论文8

最新视觉模型 DINOv3论文精读(逐段解析)

DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
新闻资讯7

Cursor滑跪开源技术报告:Kimi基模这样微调能干翻Claude

Cursor放出Composer 2技术报告力证‘自研’,基于Kimi K2.5经持续预训练和异步强化学习,测试表现好。同时,杨植麟分享Kimi团队最新思考,认为模型要规模化,断言模型训练进入第三阶段。

量子位
新闻资讯8

模型竞赛转向:决胜关键为何是“后训练”?|甲子光年

模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。

甲子光年
算法论文8

首个GUI多模态模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下多模态模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心
产品应用8

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级模型,还推出“模型+小模型”协同架构释放企业算力价值。

量子位
开源动态8

微软开源2025 ICML获奖框架,终结模型多轮对话严重缺陷

微软开源2025年ICML获奖框架CoLLabLLM,可解决模型多轮对话缺陷。它由四模块构成,经多轮对话模拟和奖励优化模型。在三基准平台测试显示,能在多样任务中高效协作。

AIGC开放社区