「性能问题」共找到 4758 篇相关文章
字节开源高效解析文档图像的新型多模态模型Dolphin,快速将复杂的文档图像转化为结构化数据。
字节开源新型多模态模型Dolphin,采用“先分析后解析”范式,能将复杂文档图像转化为结构化数据。它有卓越性能和多种特性,还提供安装、推理使用指南。
这个项目让 Clawdbot 接入飞书机器人,附教程!
该项目解决 Clawdbot 官方不支持国内通信软件问题,提供飞书等国内 IM 平台与 ClawdBot AI Agent 的桥接服务,文中介绍前置要求、安装、使用、开发等内容,还给出项目地址和教程。
Ilya Sutskever 最新毕业演讲:我们正处在人类史上最不寻常的时代,因为 AI 终将无所不能,你的未来无法逃避
Ilya Sutskever 在多伦多大学毕业演讲称,AI 终将无所不能,人类应接受现实,努力向前。他建议大家使用顶尖 AI 形成直觉,直面 AI 带来的挑战,关注并解决相关问题。
特斯拉Robotaxi首秀翻车!逆行急刹吓哭网友,半路抛客全程高能预警
特斯拉Robotaxi上线首日状况百出,如逆行、急刹、无视限速标志等。虽有惊艳表现,但问题引发关注,美国汽车安全监管机构已展开调查,若bug不修复或被召回。
OpenAI史上最快模型降临,每秒1000Token!代码从此「炸出来」
OpenAI发布GPT-5.3-Codex-Spark,它是专为实时编程设计的超高速模型,生成速度超每秒1000个token,联手Cerebras硬件,重写底座提升性能,在多项测试表现强,ChatGPT Pro用户可尝鲜。
微软介绍了 TypeScript 7 的更新
微软分享 TypeScript 7 最新进展,披露用 Go 重写编译器计划,构建速度最高提 10 倍,降低内存占用。默认启用严格模式,是不兼容变更。开发者看法不一,有人赞性能提升,有人忧工具迁移。
轻量高效,即插即用:Video-RAG为长视频理解带来新范式
现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。
ICML 2025放榜!接收率26.9%,高分被拒,低分录用惹争议
第42届国际机器学习大会(ICML)2025放榜,接收率26.9%。文章汇总了被接收的优秀论文如MARS、ShadowKV等,以及有争议的论文,一些高分被拒、低分录用,评审存在矛盾与粗心问题,欢迎读者在评论区讨论。
刚开源几周,一键深挖你的聊天数据宝藏!
这两天在Github发现开源工具`ChatLab`,它把聊天记录变“私人数据库”,支持用 SQL 和 AI 挖掘社交数据价值。具有本地隐私保护、解析性能强等特性,安装简单,适合不同用户。
超级个体不是全能战士
作者黄益贺指出“超级个体 = 全能战士”是工业时代认知。工业时代超级个体是“超级执行者”,产出线性;AI时代超级个体是“超级导演”,产出非线性,核心竞争力从“拥有技能”变为“定义问题”。