「模型训练难题」共找到 8796 篇相关文章
小红书最新开源TTS力作!4人对话自然无缝,毫秒极速响应!
近年来TTS技术爆发,但多人对话的自然流畅性和长序列稳定性一直是难点。小红书团队开源的FireRedTTS - 2是面向多人对话场景的TTS模型,实现自然切换和低延迟,支持多语言,适用于多种场景。
Computer Use:莫拉维克悖论
2025年AI在数学证明等“高阶智能”任务表现佳,在“像人类一样使用电脑”任务却受挫,再现莫拉维克悖论。文章分析计算机使用智能体是实现AGI机会与挑战,指出发展难题、探讨RL作用并给出研究方向。
继封禁中国公司后,Anthropic 刚刚宣布:支持SB 53 法案
Anthropic宣布支持SB 53法案,认为其为监管强大AI系统提供基础,通过透明度实现监管。该法案对大型AI公司提出多项要求,不过部分强大模型或不被涵盖。其他主要AI公司和部分风投机构则抵制该法案。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。
a16z 全球 AI 产品 Top100:DeepSeek 增长放缓,「中国开发,出海全球」成为新常态
时隔半年,a16z发布第五版「Gen AI消费级应用Top 100」榜单,显示AI应用生态趋于稳定。Google旗下产品增长快,Grok移动端用户大增,DeepSeek增长放缓,「中国开发,出海全球」成AI应用新常态,vibe coding类应用用户粘性高。
刚刚,GPT-5 Pro自证全新数学定理!OpenAI总裁直呼颠覆,大佬们集体转发
微软前AI副总裁Sebastien Bubeck让GPT - 5 Pro求解论文中未解数学区间,模型将已知下限从1/L推进到1.5/L,虽论文作者后续超了AI,但此发现仍令人鼓舞,大佬认为AI或改变数学领域。
语言反思>强化学习:伯克利新架构碾压传统RL
大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。
全网苦等GPT-5,超级对齐团队遗作成重要线索,奥特曼发话「惊喜很多」
AI圈聚焦GPT - 5,相关爆料多但模型未现。奥特曼称有很多惊喜。GPT - 5疑似技术通用验证器源于OpenAI论文,或代表AI发展进入新的架构突破时代。此外,有博主用疑似GPT - 5创作,效果惊人。
谷歌前CEO深度专访:AI、智能体会重塑世界
谷歌前CEO Eric Schmidt在Ted专访中,从AI起点AlphaGo说起,阐述其从大模型到自主决策智能体的发展,还提及算力电力需求增长、监管、开源等问题,虽挑战多,但他对AI重塑世界充满信心。
一句“Hi”,80$蒸发!O3-Pro:地表最强,也最“坑”的AI!
昨晚ChatGPT宕机,OpenAI 2折甩卖o3模型并发布o3 Pro。o3 Pro编程能力强,达全球top150程序员水准。官方称甩卖的o3是原版但推理快近40%。o3使用成本高,还需足够上下文。