科大讯飞」共找到 5059 篇相关文章

开源动态8

WAIC抢先爆料:金融“黑马”模型超DeepSeek刷新SOTA,论文已上线

WAIC期间,蚂蚁数金融推理模型发布会未开,论文已上线。其新模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业与通用,蚂蚁数还提出评测基准Finova。

量子位
开源动态7

新玩法!Karpathy周末手搓“模型智囊团”应用:各LLM同台互评,代码已开源

Andrej Karpathy周末手搓Web应用llm - council,让多个模型像顾问般提供建议。查询通过OpenRouter分发给多个模型,它们互评后由‘模型主席’生成最终回复,代码已开源。

AI寒武纪
开源动态8

全新OCR将图片变代码无损重绘!华中&小红书发布3B模型,图形重建超越Gemini 3 Pro

华中学与小红书联合推出MOCR,提出「解析一切」新范式,将文档图形升级为「一等解析目标」。它解决传统OCR短板,在文档解析和图形重建表现出色,还革新评估方法,代码和模型已开源。

量子位
新闻资讯7

亚马逊云中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三技术准备

亚马逊云中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。

AI前线
新闻资讯8

王小川:医疗行业对模型有三刚性要求,但通用模型一条都不达标

5月22日百川智能展示医疗模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用模型用于医疗有问题,医疗对模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。

Founder Park
算法论文8

年度AI论文!全球三顶尖模型的防蒸馏机制全面告破:小模型“套出”模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复模型隐藏思维链数据。还揭示部分模型训练或借鉴模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
推荐文章7

数据到好猜想:如何用模型做市场研究?

文章指出模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park
新闻资讯8

微软分享三王炸算法:突破模型推理瓶颈,性能

今天凌晨微软官网分享三创新算法,即rStar - Math、LIPS、CPL,可助模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。

AIGC开放社区
算法论文8

ICML 2026 | 模型内部也会长出「情绪树」,规模越越懂人心

ICML2026 论文指出,语言模型内部会自然形成类似人类心理学模型的「情绪树」,模型越,情绪树越复杂,且在销售等任务上表现更好。同时,模型的情绪结构受身份设定影响,存在与人类相似的情绪识别偏见。

机器之心
推荐文章7

模型 Token 究竟是啥:图解模型Token

文章详细解释模型Token概念,指出分词器会把文字切成Token,不同分词器切分结果不同。还介绍分词器的分词方法,通过统计文字出现频率打包成Token并编号,不同模型切分结果有差异。

机器学习AI算法工程