「多场景应用」共找到 6461 篇相关文章
继火爆全网的MCP后,Anthropic 推出全新整合功能,Claude再添连接利器
继MCP后,Anthropic推出全新Integrations功能,使Claude能与各种工具和应用无缝连接,提升协作能力,其研究能力也得到增强,新功能在部分计划测试,将惠及更多用户,助力高效完成任务。
我们试图解决FOMO焦虑:《中国AI行业系列观察报告》(一)|甲子光年智库
AI发展迅速,新突破、应用和资讯不断涌现,营销话术也加剧人们的不确定感。甲子光年智库推出《中国AI行业系列观察报告》,梳理海量信息,提供冷静务实的第三方视角。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
机械手成精了:能变形、能爬行、自己抓东西,全程无人操控
武汉大学高霄团队设计出可拆卸爬行机械手,能像普通机械手抓取物体,还能脱落爬行够取远处物品。其完成全套取物任务,未来有望用于工厂、救援、家庭等场景。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
安卓彻底变了!Gemini接管所有屏幕,苹果连影子都没追上
谷歌在 Android Show I/O Edition 宣布,Android 从「操作系统」转型为「智能系统」,Gemini Intelligence 植入安卓设备,覆盖多硬件,还推出 Googlebook。谷歌端侧铺 Gemini,云端投 Claude,与苹果策略形成对照,竞争关键在分发。
创新中心| AI视觉创意不再拼“出图快”,而是拼“人味浓”?
北京AIGC视听产业创新中心位于朝阳区,是推动影视制作基地建设的举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家伙伴。首创郎园拓展能力,项目延伸多地。
any-llm:又一个统一模型服务接口的Python代理库
Mozilla AI开发的开源项目any-llm,解决多LLM提供商接口统一问题,能让开发者用一个接口调用不同大语言模型。它吸取此前产品长处,有统一接口等优势,使用和安装简单。
Vidu Q3:「参考生」之王,让视频生成走向工业化量产时代
Vidu Q3 上线「参考生」功能,解决 AI 视频生成结果不可控问题。其画面参考范围扩大,特效、音效提升显著,还优化特定场景,接入企业级能力,让 AI 视频从创意验证走向实际生产。
GCEA-YOLO:给油田装上"防火眼",把抽烟行为检测精度拉高 20.8%
油田抽烟事故损失大,传统检测方法有局限,深度学习模型也面临难题。作者基于YOLOv11n构建GCEA - YOLO网络,含ADown、CSP - EDLAN、GFPN、EfficientHead四个模块,检测精度显著提升,还验证了泛化与稳定性,并给出复现代码。