「视角移动功能」共找到 1837 篇相关文章
8.9K Star!号称 Notebook LM 开源平替,支持 16+AI 模型,一键部署!
Google Notebook LM 虽方便,但有数据泄露风险且被平台绑定。开源工具 `open-notebook` 是其平替,支持 16 + 家 AI 模型提供商,可处理多模态内容,能本地部署保障数据安全,还具备多种实用功能。
斩获4.1K star,再见tcpdump!这款开源神器让网络分析快如闪电!
Kyanos是基于eBPF技术的开源网络分析工具,能透视Linux内核网络活动,解决分布式系统网络难题。它零配置、有内核级透视和智能流量解密能力,功能丰富,应用场景广,相比同类优势明显。
Codex现在随时能截屏你的桌面!OpenAI建议:开会前记得关
OpenAI为Codex新增Chronicle功能,可后台抓屏截图,生成记忆用于增强上下文。虽让工作流更丝滑,但有消耗配额、注入风险、存储未加密等问题,OpenAI建议开会前暂停。
18.5K star!一键将电子书转为有声读物,支持1k+语言!
开源君分享开源工具`ebook2audiobook`,能将20多种格式电子书一键转为有声读物,支持超1100种语言,有语音克隆等功能,在Github获18.5K star,安装使用简单。
Qwen 3 VL 模型已并入 llama.cpp,ollama同步支持
近日,Qwen 3 VL 系列模型合并到 llama.cpp 项目,支持图像输入和多轮对话,解决了架构兼容性问题。功能已入主干分支,运行需足够资源。Ollama 最新版同步支持其本地化。
GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026
近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。
3.3k星星爆火!Claude Design开源升级版,中文本地化,支持DeepSeek V4
Anthropic发布的Claude Design能生成UI、人机协作,但国内无法使用且不能用自己的API。Open-codesign是其开源本地化平替方案,支持多模型,功能丰富,保密性好。
Codex 独立 App 来了,这是一个新东西
OpenAI 推出 Codex 独立桌面应用,或改变 AI 编码方式。它是 Agent 的指挥中心,有 Worktree、Skills、Automations 等功能,支持双个性模式和安全沙箱,限时开放且付费用户额度翻倍。
π0引用的中国团队,又出手了:世界仿真器新作发布
Current Robotics团队发布交互式世界仿真器CurrentWorld - 0,创始人祝毅晨履历亮眼。该仿真器能跨本体、多视角、力 - 触觉预测,可用于评测机器人,还能让人类接管以探索不同动作结果。
3天5k+星标,港大开源极致轻量OpenClaw, 1%代码量打造个人专属贾维斯
硅谷被 Agent(OpenClaw/ClawdBot)刷屏,但 40 万 + 行代码让开发者望而却步。港大黄超老师课题组将其重构为 4000 行的 nanobot,保留功能且降低门槛,上线三天获 5000+ 星标。