「App 操作」共找到 864 篇相关文章
右兔短视频去水印工具正式上线!
右兔去水印工具,一键解析全网短视频,无需广告,免费下载,支持高清原画质。
Vercel 开源 Bash 工具:基于本地文件系统的上下文检索
Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。
Claude Code新功能Auto Mode能否替代人工审核?首个压力测试来了
随着AI coding agent走向“直接执行开发操作”,Anthropic为Claude Code推出Auto Mode。香港科技大学与ETH Zurich研究团队对其进行首个系统压力测试,发现Auto Mode端到端误放行率达81.0%,部分危险操作绕过审核。
三天逆袭,Sora登顶美榜!15秒大片玩疯奥特曼,全网直呼真假难辨
上线三天,Sora APP登顶美国App Store榜首,Sora 2的「客串」功能和物理智能实现音画同步,奥特曼亲自下场被玩坏。Sora 2 Pro一次可拍15秒大片。奥特曼预告两大更新,Sora却带来视频造假隐患。
让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间
谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。
所有AI工具共享记忆!MCP协议杀疯了:100%本地运行,Cursor、Claude都能用
当下多数AI工具各自独立运行,会话结束上下文即消失。OpenMemory MCP能解决AI工具记忆痛点,实现不同工具间共享上下文信息,支持100%本地运行,有跨平台支持等丰富功能。
Angular 官方的智能体 Skills 助力 AI 编程工具生成现代化的 Angular 代码
谷歌 Angular 团队发布 angular/skills 仓库,含两种智能体 Skills,能让 AI 编程智能体编写现代化 Angular 代码。这些 Skills 针对特定工具设计,开发者可安装使用,社区对此看法不一。
Gemini桌面客户端终于上线:直接读取屏幕上下文,帮你解读一切!
谷歌推出Gemini的macOS原生客户端,支持全局快捷键拉起和窗口共享。它能突破浏览器限制,基于屏幕内容提供反馈,但目前离真正的桌面助手还有差距,后续有望补齐能力。
从OpenAI AI Phone到Gemini on Android:AI手机时代需要怎样的Agent Harness?
过去一年,AI与手机关系被重新定义,腾讯混元等机构研究PhoneHarness,关注AI在手机上行动及任务完成验证问题。它让手机Agent行动不止GUI,还有Bench检验执行结果,推进AI手机基础设施建设。
剪辑 Agent 字幕升级:99% 正确率的字幕,一条指令直接推进剪映
作者成峰重做剪辑 Agent 字幕功能,结合 capcut - mate 项目,接入语音识别服务等优化流程。字幕准确率最高达 99%,还介绍了 5 步使用方法,解决非技术用户使用门槛问题。