「训练问题」共找到 4900 篇相关文章
20岁辍学生用AI帮人记笔记,半年做到500万用户,年入百万美元
Turbo AI是一款主打课堂场景的AI笔记应用,由两位20岁大学辍学生创立。过去半年用户从100万飙到500万且盈利,仅融资75万美元。它功能丰富,但也有被指是GPT套壳、价格贵等问题。
超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频大模型真香
小米推出MiMo - Audio大模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还集成TTS功能。
全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四
Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。
阿里云客服Agent业务提效实践:灵活可控的落地方法论
阿里云算法专家姜剑介绍了“阿里云服务领域 Agent 平台”及业务提效方法论。阐述 Agent 技术本质、模式,分析其给客服领域带来的价值,指出阿里云客服痛点,提出解决设计问题的方法,展示平台设计与落地成果。
他们还没毕业,就在用AI搭建自己的世界|五源小酒馆Vol.30 x AI Native创造者
本期五源小酒馆邀请三位年轻AI Native创造者,分享AI学习与创造经历。他们谈及AI对生活工作的改变、关注的产品及模型,探讨资源分配、AGI突破等问题,还交流了未来能力培养和给十年后自己的话。
OpenAI董事长Bret Taylor:2010 年的 SaaS 应用,就是 2030 年的智能体公司
OpenAI董事长Bret Taylor在对话中称,当下处于“加10倍速的互联网泡沫”时代,AI为初创公司带来挑战巨头的机会。他直言多数B2B公司“以客户为中心”是胡扯,还为AI创业者划红线,如应用公司预训练模型是烧钱。
GPT5.5 + Codex 如何跑一整夜,编程的下一步,不是辅助编程,是可托管执行单元
文章指出GPT - 5.5在Codex里展现出强大自主性,能处理长时程任务。还介绍让其跑长任务的方法及面临的问题,强调长任务需状态机、证据链等,社区也在构建相关工作流层。
斯坦福7B智能体全面超越GPT-4o,推理流登顶HF
传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。
内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源
据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型。
加一个JVM参数,让系统可用率从95%提高到99.995%
文章针对高并发系统不稳定问题,定位是系统内存索引切换时 GC 压力大所致。围绕让索引尽早晋升、直接分配到老年代等思路探索优化,经多番尝试,最终实现索引无感切换,使系统可用率达 99.995%。