「计算机使用能力」共找到 4349 篇相关文章
Self-Evolving 会是 2026 关键词吗?
2025年,Agent应用发展使LLM‘静态’局限成AI瓶颈,业界重视自进化能力,聚焦‘持续适应系统’。但该领域缺统一标准,有思潮认为统一标准、集体探索将带来机遇。还介绍了研究进展、重点演变等。
通用的dLLM开发框架,让BERT掌握扩散式对话
扩散式语言模型(DLM)因缺乏易用框架和训练成本高受限。伯克利与UIUC团队基于dLLM框架,让BERT学会对话,证明‘离散扩散 + 轻量级指令微调’可赋予BERT强生成能力,还开源全流程代码。
美团LongCat扎扎实实做了件难事:LLM数学新天花板AMO-Bench
美团LongCat团队联合高校推出AMO - Bench,用50道原创奥赛级难题评估LLM数学能力。它解决现有基准测试痛点,经四重把关构建,测试显示顶级模型表现不佳,也揭示模型提升空间大。
让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了
NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。
ChatGPT:再见「破折号」
常使用AI的人会发现,模型爱用破折号,成了检测AI文本的土办法。OpenAI CEO Sam Altman称已解决ChatGPT爱用破折号问题,按指令它会照做,但评论区有人反馈破折号仍存在。
刚刚,美团开源全模态龙猫模型,和 ChatGPT 大战 100 回合打得难解难分
美团发布开源全模态 MoE 模型 LongCat-Flash-Omni,参数 560B 激活 27B。它有真正全模态能力,采用创新架构和训练范式,基准测试表现亮眼,部分指标超 Gemini-2.5-Flash,引发网友热议。
开源PDF表单自动化神器,一行命令,把静态 PDF 变成交互表单!
平时拿到的PDF表单大多无法直接填写,操作繁琐。GitHub上的开源工具CommonForms能自动识别PDF表单区域,一键生成可填写的交互式表单,基于深度学习模型FFDNet,功能强大且使用简单,还保障数据隐私。
智驾新玩家首秀,“含模量”将成为新标准|甲子光年
9月28日千里科技召开首次品牌发布会,董事长印奇展示智能辅助驾驶系统能力。其角色从定点车企服务商变为全车企伙伴,首创‘含模量’概念,还公布‘千里计划’,欲构建跨场景智能服务体系。
让 Claude Code 在完事后,给你发条微信提醒
文章围绕让Claude Code完成任务后微信通知用户展开,介绍用hooks功能和虾推啥实现的详细步骤,还强调Claude Code是通用问题解决助手,发挥其作用需明确问题、提供思路和了解能力边界。
性能逼近闭源最强,通义实验室开源Mobile-Agent-v3刷新10项GUI基准SOTA
通义实验室开源 Mobile-Agent-v3,覆盖多平台,7B 超同类开源,32B 挑战闭源强手。它有基于云环境的全链路开源方案、全栈 GUI 能力构建和可扩展环境强化学习体系,降低部署开销。