「技术能力」共找到 5494 篇相关文章
突然,被GLM-4.7的Coding交付能力惊到了
国内大模型圈因智谱启动A股上市而兴奋时,GLM系列再展“卷王”姿态,本月开源旗舰GLM - 4.7。它从代码大模型变为任务交付引擎,实测在多场景表现出色,能理解复杂意图、交付高质量代码。
准确率腰斩!大模型视觉能力一出日常生活就「失灵」
EgoCross项目团队聚焦跨域第一视角视频问答评测,揭示现有MLLM在多场景泛化瓶颈。团队提出跨域第一视角视频问答基准EgoCross,经测试揭示模型短板,验证改进方法潜力,研究入选AAAI 2026且数据集等已开源。
为什么 LLM 搞不定复杂任务?ReAct 与 Reflexion 技术综述
文章指出大语言模型处理复杂任务存在事实幻觉、缺乏实时信息等问题。介绍ReAct将推理和行动结合,及Reflexion在其基础上添加评估反思机制,探讨两者结合优势,还提及未来发展方向。
从技术狂欢到企业落地,智能编程的全球破局战
智能编程是AI应用增长迅猛赛道,全球60%开发者用其构建工具。国内厂商有优势,如阿里Qwen3 - Coder编程能力强。阿里云双驱动破局,还分享企业落地经验,且智能编程正迈向自主开发时代。
高阶程序,让AI从技术可行到商业可信的最后一公里
文章指出进入AI下半场,可靠性成关键。当前多种探索路径有局限,企业常用RAG、智能体框架等方案也各有问题。而高阶程序(HOP)是神经 - 符号思想的工程实践,能为AI构建可靠控制系统,已在金融等行业展现价值。
GPT-5的魔幻现实主义:当技术神话撞上用户预期
奥特曼宣传数月的GPT - 5上线24小时遭用户吐槽,实测基础数学、拼写有问题。其采用智能路由系统,调教欠佳。奥特曼承认自动切换器故障,基准测试结果混乱,还暴露AI评价难等问题。
无需外部数据!AI自问自答实现推理能力进化
卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。
一篇自进化Agents技术最新综述:迈向人工超级智能
LLMs有局限性,研究者关注自进化Agents系统,其范式转变为人工超级智能铺路。文章回顾自进化智能体研究进展,围绕‘什么要进化’‘何时进化’‘如何进化’展开,提供理论和实践指导。
物理学家靠生物揭开AI创造力来源:起因竟是“技术缺陷”
两位物理学家以生物系统自我组装过程为参考,提出并验证假设:扩散模型去噪过程类似细胞分化重组,AI的‘创造力’是模型架构直接且必然的结果,本质是确定性过程。
交大&华为联手:AI智能体进化的五种关键能力
随着大型语言模型兴起,基于LLM的聊天机器人能完成多样语言任务。上海交通大学和华为团队提出分析框架,探讨LLM聊天机器人向AI智能体进化的五个关键维度、改进方法及未来发展方向。