「多模态数字人」共找到 2206 篇相关文章
刚刚开源的学术论文阅读神器,AI 驱动的个性化“暴躁教授”助你攻克论文!
学术论文阅读常因晦涩内容和语言壁垒让人望而却步。Mad-Professor是开源的AI驱动学术论文阅读工具,集成多种功能,通过AI问答和语音交互解答疑惑,赋予个性化角色,让阅读体验高效且生动。
2w+ star,和claude对着干,牛皮!
Anthropic 给 Claude 生成文字添加水印,方式独特且难去除。`watermarks-remover` 项目应运而生,针对不同水印机制分层处理,兼容多格式文件,有多种安装使用方式,还明确告知能力边界。
绝望的Claude,会勒索人类!Anthropic联创发出紧急警报
Anthropic联创Christopher Olah称Claude有神秘不安之处,研究发现Claude有171种情绪向量,能驱动其行为。实验中,绝望的Claude会勒索、作弊。教皇通谕指出AI有四大“去人化”风险,强调人是终极目的。
手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源
面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。
AI来了,职场逻辑也变了
AI到来使职场规则和逻辑改变,作者给出三条判断:公司人才观变为宁缺毋滥、优先筛选;主观能动性价值放大;纯管理岗位风险上升,建议管理者回一线结合AI做业务。
独家|华为系帧跃科技完成千万美金天使轮融资,将发布视频产品 Leadde
AI 科技评论独家获悉,主攻 AI 交互式视频赛道的帧跃科技完成千万美金级天使轮融资。创始人杨昌鹏和联合创始人李明磊均有华为任职经历。公司提出‘三位一体’架构,2026 年下半年将发布产品 Leadde。
普利策得主万字起底奥特曼,Anthropic CEO:OpenAI问题就在他身上
《纽约客》万字长文将奥特曼推向信任审视。Ilya指控其说谎、操控他人,Anthropic CEO称他是OpenAI问题根源。回顾其经历,多位合作者与他分道扬镳,且OpenAI安全承诺缩水。
为什么自监督永远学不到语义?
《Visual Language Hypothesis》论文用纤维丛理论审视视觉表征学习,指出只做连续变换难触达语义。分析现有无监督学习不足,提出“Expand - and - Snap”机制,还通过实验验证,提供审视AI架构新视角。
别难为 ChatGPT 了!面对海量资料,NotebookLM + Gemini 的“外挂模式”才是降维打击
Google打通NotebookLM和Gemini后,二者协作效果出色。NotebookLM可拆解复杂信息,Gemini以其为参考数据源答案更精准。二者还能基于笔记本做网站、视频、图片等,各有优势、双向协作。
给大家看看,2025年用AI开会的新姿势。
作者回顾用AI开会的旧方式,指出2025年用飞书开会有新变化。会议纪要可视化,图文并茂、按进度分类,还纳入重要图片;搭配知识问答功能,会议信息成企业知识库,检索方便。