「人类与AI」共找到 12836 篇相关文章
DeepSeek又又又又发新论文了!这一次,他们重构了AI看图的方式
DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。
国产芯片也能跑AI视频实时生成了,商汤Seko 2.0揭秘幕后黑科技
自Sora 2发布,科技厂商掀起视频生成模型竞赛。12月15日商汤上线Seko 2.0,实现AI短剧‘一人剧组’。其背后的LightX2V框架做到实时生成,还适配国产芯片,有望推动视频创作生产力革命。
狂揽4万星!换掉OpenClaw太爽了,5美元就能养个AI打工人
Hermes Agent是NousResearch推出的开源Agent神器,上线后在GitHub超4万星。它运行在用户服务器,有六大核心特性,能跨平台对话。技能自维护,形成记忆 - 技能 - 训练数据闭环,应用场景丰富,演进注重安全、稳定与智能。
轻量级语音模型Vui开源,支持本地部署,笑声停顿全拟真,4万小时练出人类对话感!
近日,Fluxions - AI团队在GitHub开源轻量级语音模型Vui,可设备端运行。它能精准模拟语气词、笑声等,有三款模型,适用于语音助手、播客生成等场景,解决了传统模型的痛点。
10天随手写的AI,竟在GitHub狂飙7万星!「它开口那一刻,我吓懵了」
新智元报道,Clawdbot爆火,GitHub星近7万。它由Peter一人玩10天手搓而成,自主解决问题能力惊人。后因Anthropic介入被迫更名Moltbot,还引发加密玩家不满。有人用它交易一晚赚247美元。
重写手机AI安全边界!首个MoAI攻防SoK,系统梳理三大安全支柱
墨尔本大学等联合发布论文指出,移动端AI硬件和模型发展使MoAI成重要范式,但带来安全风险。论文给出统一框架,拆解系统为四层,定义三大安全支柱,梳理攻击、防御图谱等,还提出开放问题与未来方向。
腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态大模型
多模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。
蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI榜单纪录
蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用大模型,靠数据、工具、训练方法三大创新实现突破。
2.6K Star!GitHub 上这个开源桌宠,用一只小螃蟹就能监控你的 AI 编程助手!
介绍开源桌宠 Clawd,它是为 AI 编程助手设计的实时状态监控器,有 12 种萌趣动画状态,支持 10+ 主流工具,具备权限审批等实用功能,零配置开箱即用。
Sam Altman 刚刚发文:Sora 2要高速迭代,两大变革直指版权与搞钱
Sora 2因大量侵犯日本动漫 IP 遭日本高层施压。Sam Altman 宣布立即调整,一是赋予版权方更精细的角色生成控制权,二是尝试商业化并与版权方收入分成,还会高频迭代,新方法将用于所有产品线。