大模型应用」共找到 10094 篇相关文章

新闻资讯8

解析科讯飞:把AI做成懂你的那一个|甲子光年

2025年中美AI发展路径分化,中国企业探索本土商业化道路。科讯飞董事长刘庆峰提出自主可控、软硬一体、行业纵深、个性化四个关键词。其用华为昇腾芯片训练出可商用模型,在多领域展现优势,还发布新功能和产品,为AI商业化提供“中国答案”。

甲子光年
新闻资讯8

云栖会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI
开源动态8

首个代码世界模型引爆AI圈,能让智能体学会「真推理」,Meta开源

Meta重组后的AI部门推出首个代码世界模型CWM,是320亿参数开放权重LLM。它与传统模型思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究。

机器之心
产品应用7

最强协作模型?MiniMax M2.7 实测:AI开始更会合作了 | Claude Teams

MiniMax M2.7模型发布,强调模型自我进化、Agent Harness和Agent Teams。它能构建复杂Agent Harness,完成高难度生产力任务。其能力达国际一线水平,在多测试中成绩优异。还介绍了Harness、Agent Teams等概念及应用场景。

AI进修生
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了

过去两年模型推理能力跃迁,谷歌等机构研究指出,推理能力提升源于模型推理时隐式模拟类多智能体交互结构“思维社会”,还提出利用“群体智慧”新方向,并介绍了研究方法、实验结果等。

AINLPer
开源动态8

DeepSeek重磅开源3B OCR模型,一天处理20万页文档!一天内斩获6K标星!

DeepSeek开源3B OCR模型DeepSeek - OCR,参数量仅30亿,单张A100 - 40G一天能处理20万页文档,不到24小时获6K标星。它是视觉压缩引擎,解决模型处理长文本算力爆炸问题,有诸多技术亮点。

开源星探
产品应用8

8岁小学生idea直接变应用,秒哒3.0刚刚把AI应用门槛打没了

百度在2026 Create会发布秒哒3.0,从“能做应用”跨到“能做生产级应用”,补齐从“应用”到“APP”最后一公里,进军企业级市场,降低开发门槛,让普通人也能创造应用

量子位
开源动态8

SOTA级的Embedding模型!F2LLM模型、数据、代码全部开源,人人可用

Embedding 模型应用广泛,但主流模型训练困难。蚂蚁集团与上海交推出 F2LLM,含 0.6B、1.7B、4B 系列模型,仅用六百万数据微调基座,在 MTEB 榜单领先且完全开源。介绍了其数据、训练、测评等情况。

深度学习自然语言处理
新闻资讯7

刚刚,全球最难考试惊天反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
产品应用8

华为云的组合新范式,引爆了Agentic AI应用革命

在2025全球计算会上,华为云提出Versatile智能体平台与CloudDevice云终端协同方案,致力于破解模型行业落地痛点。该方案激发AI端侧应用可能,释放云端潜力,已在多行业展现变革价值。

机器之心