「语音时长控制」共找到 1318 篇相关文章
Claude半个月连崩7次!全球宕机3小时,强制实名精准封号
Claude半个月内7次大规模故障,全球宕机3小时,开发者破防。原因是Anthropic算力储备告急,为自救拟自研芯片。此外,Anthropic还通过改定价、加闸、实名验证等措施控制成本。
OpenAI 发了一份《写好文档指南》|写文档,是一种同理心的体现
OpenAI发布《写好文档指南》,强调写文档是为把信息装进别人脑子,是同理心的体现。给出让人能扫、好读、更多人看懂等原则,如拆分内容、句子简洁等,还指出必要时可打破规则。
突发!OpenAI深夜推出浏览器ChatGPT Atlas:一文深度详细解析「率先支持mac OS」
OpenAI推出人工智能驱动的浏览器ChatGPT Atlas,集成对话式AI改变上网方式。它有随行聊天、浏览器记忆、代理模式三大核心功能,面向全球macOS用户上线,更高级功能对付费用户开放,还注重安全与用户控制。
GPT-5编程成绩有猫腻!自删23道测试题,关键基准还是自己提的
有人发现OpenAI测试GPT-5编程能力时,用的SWE-bench Verified子集仅477题,自行省略23题。若这些题默认零分,其得分比Claude Opus 4.1低。且该基准还是OpenAI自己提出的。
阿里再开源,全球首个MoE视频生成模型登场,电影级美学效果一触即达
继上周开源三连发后,阿里昨晚开源全球首个 MoE 架构视频生成模型 Wan2.2,具电影级美学控制能力。它有 MoE 架构创新等四大技术亮点,可在 Hugging Face 和阿里魔搭社区下载。
Anthropic 发布 AI Agent 上下文工程指南
今年6月Andrej Karpathy提出用「上下文工程」取代「提示词工程」。Anthropic发布工程博客呼应此观点,指出构建AI应用重心转向策划上下文。文章详述上下文工程重要性、有效上下文剖析、检索及长时任务应对技术等。
通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持
LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。
电脑操作、技能、连接器、工作伙伴:豆包的牌来了
最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。
newtype OS操作手册
作者黄益贺介绍newtype OS安装、配置与使用方法。它是定制化工具,比Claude Code更适合知识消化与内容产出。安装简单,配置需连模型供应商、给Agent配模型,使用时与Chief对话即可。