「文本生成」共找到 2519 篇相关文章
AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退
Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。
全球首个AI基因组诞生,35亿年生命代码重编程!生物学迎「ChatGPT时刻」
斯坦福联手Arc Institute,以噬菌体ΦX174为模板,用AI首次生成基因组。16个成功抑制大肠杆菌生长,还能对付耐药菌。这是AI在合成生物学的重大突破,为健康挑战提供新疗法。
华纳兄弟起诉Midjourney
Theverge消息,华纳兄弟起诉文生图平台Midjourney,称其AI工具生成大量侵犯版权的角色图像和视频,如蝙蝠侠、超人等。诉状列举侵权行为,提供对比案例,华纳希望获禁令并索赔。
谷歌全新Gemini Omni首曝,视频版「香蕉」来了!教授黑板推公式全对
谷歌原生视频模型Gemini Omni意外曝光,其生成视频的连贯性、一致性惊艳,还能实现实时编辑。此前OpenAI的Sora App停服,谷歌I/O 2026将开幕,多款Gemini模型或亮相。
个人音频转录与交互神器
Speakr是个人自托管网络应用,可转录音频、生成摘要和标题,还能通过聊天互动。支持音频上传、浏览器录音等功能,可选择不同转录方式,有简单和高级两种安装方法。
OpenAI放大招!核心API支持MCP,一夜改变智能体开发
今天凌晨,OpenAI全资收购io消息吸睛,还悄悄宣布核心API——Responses API支持MCP服务。这简化智能体开发,还能集中管理工具、保障安全。此外,Responses API的图像生成等工具也有更新,并引入新功能。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
不看后悔!GitHub 开源 MultiTalk .8k star 强大的人语音+图像绑定项目
MultiTalk 是 MeiGen‑AI 开发的开源框架,可从音频、图片和提示语生成多人对话视频。它解决传统视频制作痛点,功能亮点多,技术优势明显,应用场景广,与同类项目对比表现突出。
AI“氛围编程”威胁开源,维护者面临危机
开源维护者正加速关闭外部贡献,因AI生成贡献量大质低。研究显示“氛围编程”会造成负反馈循环,降低软件可用性和质量。平台激励加剧问题,虽有应对策略但效果不佳。
干掉同传?谷歌把AI同传放入所有耳机,顺手发了个颠覆性的AI浏览器
Google加速将Gemini融入核心产品线,向Google翻译引入其能力,带来实时语音翻译Beta版,提升文本语境理解,扩展语言学习工具;还推出实验性浏览器Disco,用AI重构网页浏览体验。