「手机使用」共找到 1475 篇相关文章
AI 画图不是玩具,而是可以变成效率工具 | 豆包 P 图Seedream 4.0 效率场景挖掘
作者测试豆包P图Seedream 4.0,发现它有对指令深度意图理解等能力且中文支持好。还分享用其提升效率的场景,如制作封面图、翻译图片文字等,也给出发掘AI应用场景思路和写画图提示词方法。
人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!
上海交大开源端侧Agent全栈工具链MobiAgent,将构建手机Agent全流程开放。它在真实场景性能超GPT - 5,还设计“潜记忆加速器”,通过三步养成Agent,评测表现出色,降低移动智能体开发门槛。
综述 | Agentic RL for LLM的最新进展与未来挑战,idea满满
该综述对新兴的Agentic RL进行系统性总结与展望,介绍其与传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战与未来方向,展示通向通用AI的希望之路。
The Batch: 871 | Mistral测量了大语言模型的能耗、水耗与物料消耗
法国AI公司Mistral发布对Mistral Large 2的环境分析报告,涵盖全生命周期影响。研究表明单次使用影响小,但累计负担大。虽研究有不足,但其方法或推动环保型AI发展。
完全离线!开源实时语音识别神器,本地实时语音转文字,秒级延迟+说话人识别!
实时语音转文字和说话人识别需求渐长,但传统工具多依赖云端,有隐私与延迟问题。GitHub上的开源项目WhisperLiveKit是本地化语音识别方案,速度快、延迟低、支持说话人识别,适合会议等场景。
用“蒸汽机”生成视频,还能音视频一体化交付?
8月21日百度营销发布百度蒸汽机2.0,含多版本,有声版可音视频一体化交付。经测试,其生成视频细节佳、运动规律合理。它能解决影视业诸多痛点,成本低,还可免费使用。
我的Codex是Claude Code 帮忙装好的……
OpenAI的Tibo称Codex CLI支持ChatGPT账号登录,Plus和Pro订阅用户可在命令行用GPT - 5。作者安装Codex遇问题,Claude Code帮忙解决。测试发现Codex有提升空间,作者认为Claude Code功能强大,建议人人开Claude Code Max。
Z世代生存、学习与未来宣言!伯克利学霸预言课堂,用AI设计人生
本期OpenAI播客中,USC的Yabi和伯克利分校学生分享AI使用体验。谈及教授适应AI的教学转变、‘学习模式’特点、‘作弊’新定义,还大胆设想AI完成教育授课,人类导师培养社交技能。
40.9K Star 数据可视化神器!Json数据处理领域的“瑞士军刀”!
在数据驱动场景中,解析复杂嵌套JSON结构费时费力。GitHub上标星40.9K的开源工具JSONCrack,能将JSON数据可视化为交互式节点图,还有转换、格式化等功能,使用简单,应用场景广。
谷歌开源高效文本提取 Python 库LangExtract
谷歌开源 Python 库 LangExtract,能用大语言模型从非结构化文本提取结构化信息。它定位精确、输出可靠,支持多模型,适应多领域,还能处理长文档,通过示例介绍了使用方法。