「计算机使用智能体」共找到 4679 篇相关文章
DeepSeek-V3.1 发布,官方划重点:Agent、Agent、Agent!
2025年8月21日,DeepSeek V3.1正式发布。它采用混合推理架构,支持双模式,网页端、App、API均升级,上下文拓展至128K。其智能体能力增强,思考与输出效率提升,还具备API新特性,模型已开源,价格也将调整。
微软最新揭秘:「话痨实习生」AI助手,到底能帮人类做什么?
基于20万微软Copilot使用数据的研究指出,AI能支持研究、写作和沟通任务,但无法完全胜任单一职业所有任务。Copilot执行任务多为解释型,写作和信息收集任务满意度高,语言和创作类职业受影响大。
扎克伯格看OpenAI直播挖人,北大校友孙之清加入Meta
本周五,前OpenAI研究科学家Hyung Won Chung晒照,显示他、孙之清与Jason Wei已加入Meta新成立的超级智能实验室。孙之清曾是ChatGPT Agent核心开发者,还和山姆・奥特曼直播发布该产品,一个月后跳槽。
o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界
GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。
谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!
在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是高精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。
Claude Code + GLM-4.5,最强性价比编程组合教程首发
7月国产开源大模型竞争激烈,智谱发布的GLM - 4.5刷新开源大模型编程和agent能力。它成本低、速度快,还能与Claude Code配合。文章介绍该模型特点,分享二者使用教程及原型设计、网站开发等实测案例。
OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!
半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。
13年死磕一个真理,这家中国AI黑马冲刺IPO
云知声深耕AI 13年,即将冲刺港交所IPO。它从单一语音识别发展为全栈AGI方案商,以智慧生活和智能医疗双轮驱动,营收稳健增长。其坚持技术创新,构建全栈自研体系,有望在AI时代持续领跑。
OpenAI深夜数连发:o3降价80%,o3-pro上线,奥特曼最后一次手发长文,开源模型却延期了……
OpenAI昨夜动作不断,o3模型降价80%,o3 - pro发布,开源模型延期。Sam Altman发长文《温和奇点》,预测AI发展时间线。o3价格虽降但使用成本仍有差异,o3 - pro性能强却推理慢,开源延期引发猜测。
Token纪元:从「马力」到「人天」再到「兆字元时」的认知革命
文章指出,AI时代需全新生产力计量单位“马斯”。字元是AI“语言燃料”,但缺乏统一计量体系。智能社会的容量、速度、价格是关键指标,当前AI算力网络停在2G时代,AI劳动力崛起将重构就业,Token或引发文明跃迁。