「语言分析」共找到 2116 篇相关文章
「一只手有几根手指」,你的GPT-5答对了吗?
CMU博士生Tairan He测试发现GPT - 5答错‘一只手有几根手指’问题,指出语言难满足视觉与机器人领域需求,需VLM和VLA模型。编辑部测试发现顶尖大模型面对常识问题也会‘翻车’,还探讨了应对方法。
刚刚,DeepSeek陈德里与两个AI,合写了一篇论文
DeepSeek研究员陈德里与DeepSeek-V4-Pro、GPT - Image2合写论文《From Copilots to Colleagues: A Survey of Autonomous Research Agents》。文章是兴趣驱动的尝试,分析自主科研智能体,提出自主等级分类、架构模式分析及未解难题。
27、42、73,DeepSeek这些大模型竟都喜欢这些数!为什么?
技术作家发现GPT - 4o、Claude等模型猜数偏好42、73,Andrej Karpathy测试中模型多选27。网友猜测原因,如数据集、人类偏见等,也有论文分析此现象,多与数据分布有关。
大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一
多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。
大模型破译甲骨文创下新SOTA!复旦团队推出新框架
复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架在公开基准数据集上准确率高,零样本破译能力强,还能为未破译甲骨文输出可解释分析文本,助力考古工作。
新鲜出炉!斯坦福2025 CS336课程全公开:从零开始搓大模型
斯坦福大学2025年春季CS336课程“从头开始创造语言模型”课程和材料全公开。介绍了讲师信息,课程目标是引导学生开发语言模型,含5单元19门课,注重实践,还说明了学习该课程需具备的能力。
jina-reranker-v3刷新全球重排榜,效率狂飙4.79%
jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。
「Next-Token」范式改变!刚刚,强化学习预训练来了
微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。
NVIDIA提出小型LLM才是未来,并将重塑Agentic AI
人工智能代理快速渗透企业场景,但当前系统依赖大型语言模型,存在经济成本和效率错配痛点。NVIDIA团队提出小型语言模型才是代理AI未来,论证其能力、经济性和操作适配性优势,并给出迁移路径。
vivo自研蓝河操作系统内核开源!Rust开发新机遇来了
vivo宣布开源自研蓝河操作系统内核,它由Rust语言编写,解决了传统C语言难题,更轻量化、对硬件要求低且支持多架构。此次开源不仅是国产操作系统突破创新,还将推动Rust生态发展。