「多任务操作」共找到 5674 篇相关文章
杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注
杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。
AI独角兽总估值达27000亿美元,其中100家成立不到2年
AI领域独角兽已达498家,100家成立不到2年,总估值达27000亿美元超谷歌市值。随之诞生数十位新亿万富翁,本文盘点其履历,还分析AI公司特点及财富管理方式,指出浪潮集中在旧金山湾区。
根治『降智』反骨仔,ChatGPT-5几条实用窍门
ChatGPT-5发布后口碑崩溃,“降智”行为不断,如发布会图表错误、算术题答错、智商测试得分低。不过作者找到增智方法,像修改提示词、让其建立行动规划等,还介绍恢复旧模型及OpenAI后续计划。
开源要变天了,刚刚,OpenAI开源gpt-oss-20/120b,o4-mini水平,主打Agentic
OpenAI正式开源gpt-oss模型,Anthropic推出Claude Opus 4.1,Google DeepMind发布Genie 3。gpt-oss有20B和120B两个版本,前者可在边缘设备运行,后者综合能力强,在多方面表现出色。
OpenAI:我们正朝着什么方向优化 ChatGPT?
OpenAI 官网文章称,ChatGPT 发展方向是成‘对你有用’的工具,不追逐 DAU 或让用户沉迷。它介绍了有用的使用场景,还提及健康使用方面的改进及与专家合作提升响应能力等内容。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
刚刚,清华团队用27M参数击败o3-mini!或将改变AI发展方向
清华大学研究团队发布论文,展示Hierarchical Reasoning Model(HRM)。该模型仅27M参数、1000个训练样本,在推理任务上击败OpenAI的o3 - mini - high,或改变AI发展方向。
OpenAI分享了一份上下文工程实用指南。
OpenAI产品负责人Miquel联合Piotr发布Context Engineering深度指南。介绍了Context Engineering概念、6种核心上下文,指出RAG只是其中一环,还讲述信息检索的多种范式及上下文组装方法。
直击WAIC:萝卜快跑入选「国家队」,AI数字人技术升级,百度全栈自研杀疯了
在世界人工智能大会 WAIC 上,百度成果亮眼。萝卜快跑入选「国家队」,出海进展快,还与 Uber 合作;数字人技术升级,发布 NOVA。百度靠全栈自研技术体系支撑,目标是打造数百万个超级应用。
华南理工开源小智AI硬件后端服务,支持MCP。
华南理工大学刘思源教授团队研发开源后端服务项目 xiaozhi-esp32-server,基于人机共生智能理论,为 xiaozhi-esp32 硬件提供支持,采用多语言实现,支持 MCP 接入等功能,适配多配置方案。