「实测案例」共找到 737 篇相关文章
社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!
阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。
腾讯开源WMT2025冠军大模型:拿下30个第一,同类最佳
昨晚腾讯开源WMT2025冠军翻译大模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过多场景翻译案例展现优势,有望推动高质量翻译普及。
被曝蒸馏DeepSeek还造假!欧版OpenAI塌房了
被誉为欧洲版OpenAI的Mistral被离职员工爆料多项黑幕,其最新模型疑似直接蒸馏自DeepSeek,却包装成RL成功案例,歪曲基准测试结果。此前就有人发现其模型与DeepSeek相似,目前官方暂无回应。
特工现场实录|纳米 AI 如何构建 L4 蜂群系统?
纳米AI更新发布L4级多智能体蜂群系统,将“协作”能力写入Agent系统底层。该系统采用三层架构管理运行逻辑,通过协作空间与A2A通信协议配合,实测稳定性佳。平台降低开发门槛,后续规划聚焦多方向。
用AI,写代码只会更慢!但一定更「快乐」
METR研究实测发现,GPT等AI编程工具让顶尖程序员写代码平均慢19%,效率不升反降。开发者本预计提效24%,体验后仍觉快20%。研究还分析变慢原因,提醒勿高估AI编程能力。
颠覆医学!AI帮助无精男喜当爹,800万扫描找出3个生命火种
全球著名媒体CNN消息,一对饱受18年不孕不育折磨的夫妇,在哥伦比亚大学生育中心用STAR方法,靠AI在精液样本中找到3个精子助妻子受孕。STAR由该中心团队耗时5年研发,为患者提供新选择。
太多人误解了「苦涩的教训」
《“苦涩的教训”》一文常被误解,其核心观点是能充分利用计算资源扩展的方法会超越不能扩展的方法。人类知识短期易获好结果,但长远看,唯有随算力增长的方法最终胜出,如深蓝、AlphaGo Zero的案例。
小米玄戒O1,五个争议问题与解释
文章围绕小米玄戒O1提出五个争议问题并解释。涉及是否为国产、自研芯片,手机SoC研发难点、小米做SoC原因及玄戒O1是否成功,还结合苹果、高通等案例阐述芯片产业分工等知识。
人工智能驱动的科研新范式及学科应用研究
文章指出AI驱动的科研新范式通过数据、算力、算法深度耦合嵌入科研全过程,引发多方面变革。总结其特征与演化方向,分析学科应用要求与成功案例,还提出我国推动AI科研应用的启示与建议。
突发!Fable 5.1遭黑客破解,27万字提示词泄露
Fable 5.1和Mythos 5.1发布,Fable 5.1推理成本低32%。但发布几小时后被破解,27万字提示词泄露,曝光了其安全限制、隐私保护等秘密。它工具增加,还破解密码、能完成多种任务,不过也有用户抱怨耗token等问题。