「人类与AI」共找到 12838 篇相关文章
谷歌重磅发布Flow,人人都能制作好莱坞级电影
谷歌在‘I/O 2025’大会发布影视级AI制作工具Flow,它是Video FX迭代版,由Veo 3、Imagen和Gemini支持。具备专业影视制作功能,已有知名制作人用其产出高质量作品,已开放使用。
会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力
过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。
临时文件自动归档工具|解放双手,杂乱文件自动整理归档!
乡长分享基于AutoHotkey V2等4种AI工具开发的临时文件自动归档工具,可解决文件混乱问题。它能监控指定文件夹,自动搬运归档符合条件的文件,新版本功能强大,操作简单。
刚刚,Anthropic分享了构建Skills的最佳实践
Anthropic获300亿美元融资,估值达3800亿美元,发布《The Complete Guide to Building Skills for Claude》指南。介绍Claude Skills本质、与MCP关系、应用场景、技术实现、设计模式及测试迭代方法。
Open Responses 规范实现智能体式 LLM 工作流的统一
OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片化,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。
Demis Hassabis 达沃斯访谈:比工业革命大 100 倍的变革
2026年1月达沃斯论坛,Bloomberg主持人Emily Chang采访Google DeepMind CEO Demis Hassabis。访谈涉及AGI时间线、中国竞争等热门议题,Hassabis认为AI变革是工业革命100倍,还分享对各方面看法。
Mistral 3发布,14B多模态小模型表现优异
Mistral AI第三代模型发布,含三个小型密集模型和稀疏混合专家模型Mistral Large 3,全用Apache 2.0许可。有多项技术亮点,Ollama等支持部署微调,还给出实用配置建议。
牛B, 我去,新手小白也能使用InfiniteTalk搭建属于自己的数字人啦 ,真的太简单啦!!!
文章聚焦InfiniteTalk,剖析数字人视频制作痛点,阐述其以“稀疏帧视频配音”破题,具备无限长度、全身与表情同步等优势,介绍核心功能、使用方法,对比同类项目,凸显其多方面优越性。
首个MCP架构、只50行代码就能实现高效RAG的开源框架UltraRAG 2.0
检索增强生成系统(RAG)复杂度提升,使科研人员面临高昂工程实现成本。清华大学、东北大学、OpenBMB等联合推出UltraRAG 2.0,基于MCP架构,降低技术门槛与学习成本,让科研专注创新。
杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注
杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。