「语言世界模型」共找到 8292 篇相关文章

算法论文8

LLM的快速、慢速与工具增强思维模式综述

大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。

深度学习自然语言处理
算法论文8

南大周志华团队最新力作:一个算法通吃所有,在线学习迎来新范式?

世界是动态变化的,AI 模型需具备在线学习能力,领域提出适应性遗憾值指标。现有算法通用性不足,南京大学周志华团队研究具有双重自适应性的通用算法,提出元 - 专家框架等,还研究了在线复合优化问题。

机器之心
新闻资讯7

Anthropic官宣「封杀」OpenAI!GPT-5发布在即,竟被曝用Claude Code做开发?

本周二,Anthropic切断OpenAI对其大语言模型的Claude API访问权限,指其违约用Claude支援GPT - 5开发及安全测试。此举标志AI巨头围绕数据与接口展开新一轮封锁战,API成战略资源。

新智元
产品应用8

深谋科技重磅发布真正为人类服务的新一代人形机器人核心技术「声波传感 · 意念控制 · 高精视觉 · 类脑智能」

深谋科技将在2025 WAIC展示陆上具身智能人形“美猴王”和空中具身智能巨兽“星汉一号”,并发布新一代人形机器人核心技术,包括传感、脑机交互等系统,构建具身智能全域系统闭环。

AI科技评论
推荐文章8

不死的程序员

文章回顾计算机技术演进中八次“程序员替代论”浪潮,从编译器诞生到如今大语言模型崛起。虽每次都预言程序员被取代,但实际是角色重塑、分层,新需求增长超人力节省,程序员价值仍在。

AI科技大本营
算法论文8

0%通过率!Code神话泡沫!LiveCodeBench Pro发布!

国际算法奥赛金牌得主团队测试20个顶级大模型,在584道编程赛题上,高难度题目AI通过率为0%。论文发布LiveCodeBench Pro评测方法,揭示AI编程能力神话泡沫,指出其问题并给出提升方向。

深度学习自然语言处理
产品应用8

OpenAI推出云端编程智能体Codex,进一步推动软件工程领域变革

OpenAI昨夜发布研究预览版Codex,一款集成在ChatGPT中的高级编码智能助理。它基于codex - 1模型,支持多种编程语言,有深度代码分析等核心功能,还有codex - mini - latest API版本,或重构软件开发行业。

AI工程化
新闻资讯8

刚刚,Fable-5之下,智谱开源的GLM-5.2拿下AI编程第一!

智谱开源的GLM - 5.2在AI编程领域成绩斐然,在Arena获全球第二、Design Arena全球第一,八项基准测试表现亮眼。经多方面实测,它在长程任务中优势明显,标志国产开源模型进入开发者工作流和硬核工程阶段。

量子位
产品应用7

2亿多人开始和AI打电话,他们在聊什么?

2025年12月豆包月活达2.27亿,越来越多人与它语音通话。此前AI语音交互存在问题,豆包升级为全双工模型,体验更像打电话。作者实测其在不同场景表现出色,还分享使用技巧,并对比了和ChatGPT语音的优劣。

花叔
产品应用8

重磅!Anthropic又一个平台级产品炸场:Harness难题一次性解决,把Agent宠物变成牲口

Anthropic推出Claude Managed Agents,一套为云端大规模构建和部署智能体设计的API套件,已在Claude Platform上线公测。它全托管基础设施,专为Claude模型优化,多家企业已在生产环境使用,还同步发布工程博客解释架构设计思路。

AI寒武纪