「图片处理工具」共找到 2849 篇相关文章
突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体新范式!
在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。
“设计师的 Cursor”!拖拖拽拽就能做前端,AI 实时生成代码,代码设计双向同步!
Onlook是号称‘设计师的Cursor’的开源工具,可让用户在浏览器可视化构建前端界面,通过AI驱动双向绑定实现设计与代码实时同步,还具备多项核心功能,适用于多种场景,解决设计与开发痛点。
一键开关灯!谷歌用扩散模型,将电影级光影控制玩到极致
Google推出LightLab项目,可从单张图像精准控制光影,解决传统光影控制难题。其通过特殊数据集微调扩散模型,让模型学会控制光照,还介绍了方法、后处理流程等,实验显示表现优,有多种应用。
人才黑洞!UC伯克利系主任都加入A社了
UC伯克利EECS系主任Jelani Nelson暂离大学,加盟Anthropic预训练团队。他算法课播放量超2100万,研究聚焦大规模数据高效处理,这正是A社所需,此前他还在谷歌兼职。
5.6K Star!原本付费现在开源!本地版“ElevenLabs”,视频翻译+声音克隆全免费!
今天给大家安利GitHub上开源神器Voice - Pro,它原本是商业付费软件,因团队无暇管理而开源。整合多个先进语音模型,将视频处理流程打包成本地软件,免费且功能强大。
我的AI OS搭建思路
作者黄益贺分享AI OS搭建思路。其系统以Claude Code为框架、Kimi K2 Thinking为模型,通过Skill和自定义命令满足工作需求,设计三层文件夹体系处理信息,供大家参考搭建。
狂涨14.4K star!大三学生开发的Github可视化利器,真吊!
开源君介绍`gitdiagram`,这是结合AI与Web开发栈的开源工具,能将GitHub仓库变成交互式架构图。由大三学生开发,获14.4k星标,微软等企业团队采用,性能佳、使用便捷。
麻省理工AI放王炸!无需说话、秒懂你的想法,外挂AI大脑来了
今天凌晨2点,麻省理工学院分享突破性研究Alterego。它是可穿戴无声语音交互AI设备,通过捕捉神经肌肉信号实现无声沟通,处理后用骨传导耳机反馈结果,应用场景广泛,还能帮助残疾人交流。
AI 编码圈新卷王 Magic Path 来了,Claude Engineer 团队出品,号称UI设计的 Cursor 时刻。
Magic Path是Claude Engineer团队推出的AI驱动UI设计工具,非开源但有免费额度。它AI先行,能按提示词生成组件和React代码,亮点诸多,上手体验佳,生成UI可用,还有页面串联等功能,虽有不足但潜力大。
Google推出Gemini Spark:不用开电脑也能24小时跑
Google在2026年I/O大会推出个人AI代理产品Gemini Spark,是24小时数字生活助手。它搭载Gemini 3.5大模型,用自研Antigravity框架,运行在Google Cloud虚拟机,可对接Google工具,后续将通过MCP接第三方服务。