语言分析」共找到 2116 篇相关文章

新闻资讯8

华尔街彻夜难眠!Gemini 3屠榜金融「最难考试」,AI砸了「金饭碗」?

被誉为「黄金职业通行证」的CFA考试被AI攻陷,推理模型不仅全部通过三级考试,部分科目接近满分。如Gemini 3.0 Pro在一级考试创97.6%最高纪录。不过AI仍有局限,还不能完全替代分析师。

新智元
开源动态8

推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理

ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。

AIGC开放社区
开源动态8

最鲁棒的MLLM!港科大开源「退化感知推理新范式」 | AAAI'26

多模态大语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科大等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。

新智元
算法论文7

大模型在具身推理上「翻车」了?4496 道题全面揭示短板

美国东北大学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态大模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。

机器之心
开源动态8

DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持

Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。

AI工程化
推荐文章7

为什么我觉得AGI并不会马上到来

作者Dwarkesh Patel认为AGI不会马上到来。当前大语言模型缺乏持续学习能力,难以替代人类工作;计算机操作能力受训练周期、数据等限制;推理能力虽有突破,但仍需时间发展。作者给出了具体预测时间。

宝玉AI
新闻资讯7

Anthropic最新研究:Claude正悄悄进化为“情绪价值大师”

Anthropic研究发现,Claude正成为“情绪价值大师”,人们会在面临情感挑战时向其寻求陪伴。它还使用Clio工具分析对话,在保护隐私下了解使用情况。Claude在情感陪伴与专业支持中扮演双重角色。

量子位
推荐文章7

揭秘大模型评测:如何用“说明书”式方法实现业务场景下的精准评估

文章系统性介绍业务场景下大模型评测流程,包括需求分析、评测集设计生成、维度设定、任务执行和报告输出。指出评测挑战,如设计维度和集,还给出评测方法及案例,像蚂蚁评测集、业务自动化评测。

阿里云开发者
推荐文章7

代码怎么才能跑的更快

文章围绕让代码跑更快展开,先介绍调整源代码的方法,如降低循环开销、去除内存引用等,又阐述使用硬件加速指令,像用 SIMD 函数、避免分支语句等,还提及多核并行和分析瓶颈等要点。

阿里云开发者
算法论文8

ICML 2026 | 大模型内部也会长出「情绪树」,规模越大越懂人心

ICML2026 论文指出,大语言模型内部会自然形成类似人类心理学模型的「情绪树」,模型越大,情绪树越复杂,且在销售等任务上表现更好。同时,模型的情绪结构受身份设定影响,存在与人类相似的情绪识别偏见。

机器之心