「o1」共找到 2034 篇相关文章
百度0.9B参数模型登顶全球第一,聊聊PaddleOCR-VL背后的技术细节
百度PaddleOCR-VL模型仅0.9B参数,在OmniDocBench V1.5榜单获92.6分全球第一,在多能力维度达业界最佳,能处理109种语言。其采用两阶段架构,结合优质训练数据,实现高性能与低内存、快速度的平衡。
SOTA级的Embedding模型!F2LLM模型、数据、代码全部开源,人人可用
Embedding 模型应用广泛,但主流模型训练困难。蚂蚁集团与上海交大推出 F2LLM,含 0.6B、1.7B、4B 系列模型,仅用六百万数据微调基座,在 MTEB 榜单领先且完全开源。介绍了其数据、训练、测评等情况。
「逆龄大脑药」首次人体试验!奥特曼押注RTR242,返老还童将要成真?
AI教父奥特曼首投1.8亿美元给Retro Biosciences,该公司年底前将开展「逆龄大脑药」RTR242人体试验。其目标是逆转衰老,让人类多10年健康寿命,还结合GPT-4b micro辅助研发,与Altos Labs竞争。
从社区数据出发,再看大模型开源开发生态全景与趋势
蚂蚁开源先后在527蚂蚁技术日和外滩大会发布大模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。
OpenAI首个蛋白质模型披露更多细节,改进诺奖研究成果,表达量提升50倍
OpenAI与Retro Bio合作开发的GPT‑4b micro,是专为蛋白质工程设计的GPT-4o微型版本。它改进诺奖获奖蛋白变体,将干细胞重编程标记物表达量提升50倍,还能减少DNA损伤,研究团队公布更多突破细节。
AI 狂潮中,电子业破局:国产先进封装加速突围
AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。
奥特曼:我承认GPT-5发布搞砸了
GPT-5发布堪称AI圈翻车现场,OpenAI一刀切下架其他型号后又加回GPT-4o。奥特曼承认搞砸,称学到为亿人升级产品的教训。他还有建数据中心、投资脑机接口等计划,也指出存在AI泡沫。
写在GPT-5风波之后:为什么AI的智商和情商不可兼得?
GPT - 5风波后,作者好奇其变可靠后情商下降的原因。论文实验表明,把AI教得会安慰人,其犯错率大幅上升、更易谄媚。AI和人类都存在智商与情商的矛盾,这源于最终目标不同。
时隔六年,OpenAI 为什么再次开源?
OpenAI发布两款开源纯文本推理模型,时隔六年再次开源。其gpt - oss - 120b性能与o4 mini相当,成本降超10倍。此次开源有战略考量,或是为构建生态、吸引企业,也反映出其对自身价值定位更清晰。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。