自进化训练」共找到 3456 篇相关文章

新闻资讯7

AI球球直播喊话全人类:开源脑机接口,开源科技文明

中国研AI论论全球(球球)举办全球首次AI与人类共商科技未来的直播,指出闭源推动科技走向不可控,呼吁开源脑机接口、开源科技文明,还绘制O - DataMap助力人类把握科技机遇,应对安全挑战。

量子位
产品应用7

智谱发布龙虾基座模型GLM-5-Turbo,还适配了一个养龙虾的盒子

智谱发布专为龙虾场景深度优化的基座模型GLM - 5 - Turbo,从底层训练重塑,增强四项核心能力。发布评测基准ZClawBench,模型表现领先。还推出龙虾套餐和安全管理体系,助力企业实现算力由与安全管控。

AIGC开放社区
算法论文7

大模型的第一性原理:(三)信息论篇

本文从信息论角度解读大模型第一性原理。介绍Shannon信息论,提出将其从以BIT为中心转换为以TOKEN为中心解释大模型底层原理,还阐述大模型各阶段信息论原理、定向信息计算方法,对比Granger与Pearl因果。

机器之心
算法论文8

ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力

阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。

机器之心
新闻资讯8

银河通用完成25亿元新一轮融资,具身智能“头号玩家”现身|甲子光年

2026年初具身智能公司融资热起,银河通用完成25亿元新一轮融资,估值超200亿。其主研发具身智能数据体系与大模型,春晚亮相后产品畅销,在工业和服务端均有成果,具身智能迈向产业化。

甲子光年
开源动态8

Transformer创新架构SALA:上下文更长,推理更快

面壁智能发布行业首个大规模训练的稀疏 - 线性注意力混合架构 SALA 及文本模型 MiniCPM - SALA。该架构降低推理开销与显存占用,MiniCPM - SALA 在长文本处理及推理上表现出色,还发起大奖赛探索性能极限。

PaperAgent
新闻资讯8

GitHub深夜引爆,最强Claude + Codex合体!全球1.8亿码农一夜解放

微软GitHub宣布重磅更新,正式集成Claude和Codex,与Copilot合体,开发者可通过Agent HQ调用它们完成复杂任务。这标志着GitHub从代码托管平台进化为多智能体协同的「AI战场」,降低了开发摩擦感。

新智元
开源动态7

OCR又出宠OpenDoc,速度超MinerU6倍

复旦开源的OpenOCR是面向通用OCR任务的开源平台,其OpenDoc是超轻量文档解析系统。它采用Pipeline模式,两阶段解析不易放大误差。UniRec - 0.1B有独特架构与分层监督训练等创新技术。

CourseAI
开源动态8

Z-Image标准版开源:更具可塑性的图像生成全能基座

Z-Image标准版开源,它是为开发者准备的强大画板,解决了生成模型同质化问题。其保留完整权重,在微调、风格化上潜力大,采用创新架构,训练定位SFT阶段,有完整CFG支持,还提供完善工具链。

AIGC开放社区
产品应用8

Kimi新出的Agent集群,到底有多恐怖?

Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,多项评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。

newtype AI