「4K-Agent」共找到 4353 篇相关文章
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。
4 万星开源项目被指造假!MemGPT 作者开撕 Mem0:为营销随便造数据,净搞没有意义的测试!
高人气开源智能体记忆项目 Mem0 发布论文,称在 LOCOMO 测试打败对手。MemGPT 创始团队 Letta AI 联合创始人公开指控其造假,称测试无意义,自己轻松超其基准数据。二者都为解决大模型长期记忆问题而诞生。
4万星开源项目被指造假!MemGPT作者开撕Mem0:为营销随便造数据,净搞没有意义的测试!
高人气开源智能体记忆项目Mem0在论文中称在LOCOMO上打败所有人,MemGPT联合创始人公开指控其测试无意义、数据造假。二者都为解决大模型长期记忆问题,Letta认为能力比工具重要,并给出评估智能体记忆能力的方法。
o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界
GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。
Github 轻松斩获 30k+ Star,桌面应用开发太丝滑,Tauri框架能重塑桌面App开发?别错过,抓紧上车
Tauri是开源框架,用Rust后端和本地WebView,打造轻量、高性能、安全的跨平台应用,在GitHub获超30000 Star。它能解决Electron应用体积大、性能慢等痛点,功能亮点多,应用场景丰富。
视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式
香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。
什么情况,一夜之间冲上热搜,狂揽29.6k星,再见吧SQLite!这个嵌入式分析引擎实在太香了
DuckDB是嵌入式OLAP数据库,被赞“分析型SQLite”。它采用列式存储和向量化查询引擎,性能佳,功能多,适合探索性数据分析等场景,能替代Pandas等,成本低。
登顶全球权威榜单!浙大创业团队百卡打造开源实时世界模型,视频秒变可交互4D世界
全球科技界正豪赌「世界模型」,但主流模型多停留在「视觉生成」。中国影溯公司发布并开源世界模型 InSpatio - World,综合性能优异,以小博大登顶权威榜单,降低了物理世界数字化门槛,引发行业关注。
凌晨三点写代码、10个 Agent 同时跑!ClawdBot 创始人自曝 AI 上瘾史:Claude Code 入坑,Codex 成主力
本文讲述 ClawdBot 创始人 Peter Steinberger 的开发经历。他曾打造知名 PDF 框架,后经历倦怠回归,借 AI 重塑开发方式。分享入行故事、用 AI 编程的日常及构建 ClawdBot 的过程,探讨软件工程变化及对新人的建议。