「Qwen2.5-0.5B」共找到 3917 篇相关文章
说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!
作者提前2天拿到Qwen3.7-Max内测,经测试,该版本补齐短板,综合能力强。审美提升明显,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具里。
刚刚,OpenAI Sora 2重磅登场!首个APP上线,或将成为AI时代新TikTok
凌晨1点,OpenAI推出Sora 2,AI视频迎来「GPT - 3.5时刻」。它物理智能提升、实现音画同步,人物一致性等刷新SOTA。Sora App上线或重塑短视频交互与社区互动,还在安全治理上布下多层防线。
大模型七连发,外国人馋透了!阿里云栖大会全栈升级够狠
阿里在2025云栖大会全栈升级,发布七款通义新模型,从基础大模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。
仅用提示词工程摘下IMO金牌!清华校友强强联手新发现,学术界不靠砸钱也能比肩大厂
清华校友杨林和黄溢辰,仅用提示词设计和自我迭代验证流程,让基础模型Gemini 2.5 Pro达到IMO金牌水平。他们设计的流程分六个步骤,用差异化提示词,最终为5道题生成严谨解答。
马斯克开源新模型:能实时抓取社交平台数据,20万块H100训练
马斯克旗下xAI开源去年最佳模型Grok - 2.5,6个月内还将开源旗舰模型Grok 3。Grok - 2.5可实时抓取社交平台X数据,用超20万块H100训练,性能超GPT - 4o等,应用场景广泛。
马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行榜曝光,AGI的尽头是卖薯片?
新智元报道,「Vending Bench」榜单让大模型经营自动售货机一较高下。Grok - 4卖货能力超GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。
马斯克最大算力中心建成了:全球首个GW级超算集群,再创世界纪录
全球首个GW级超算集群Colossus 2正式投入运行,马斯克称其4月将升级至1.5GW。这为Grok 5训练提供强大算力。但美国部分地区因数据中心电力需求激增,或在用电高峰对居民轮流停电。
李开复入场Agent!零一万物推出“万仔”,直接对话CEO走独特“一把手工程打法”
今早,李开复宣布零一万物升级万智平台2.0并推出企业级Agent智能体。他指出AI Agent正重构企业架构,零一万物采用“一把手工程打法”,万智2.0有五大功能,还预计了AI Agent三个演进层级。
谷歌T5Gemma重燃架构之战!「套壳」反杀Gemma本尊,9B推理快得离谱
2023年以来大模型战场由decoder - only架构主导,Google双线出击。T5Gemma重燃encoder - decoder架构战火,性能提升显著;MedGemma坚守decoder - only路线,强攻医疗多模态,击穿闭源壁垒,打响开源反击战。
DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5
DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。