从零训练」共找到 4868 篇相关文章

新闻资讯7

扎克伯格大力招聘AI人才,Meta股价创历史新高

今天凌晨CNBC消息,Meta股票创历史新高,达每股747.90美元。这凸显投资者对其新AI小组的兴趣。Meta加入AI竞争,CEO扎克伯格积极招聘人才,Scale AI、Safe Superintelligence等挖人,还OpenAI挖走多位顶级人员。

AIGC开放社区
推荐文章8

破除AI Agent自主操控风险:万字解读LangGraph“人工干预”机制 ,附基础实战

随着LLM驱动的Agent学术走向应用,确保其行为的可靠性、安全性与可控性成关键挑战。文章以LangGraph为例,介绍其人工干预机制的核心原理、四大经典模式及案例实践,助开发者构建可靠、安全的智能代理。

腾讯技术工程
产品应用7

Alibaba力作:Ovis-U1 融合理解、生成与编辑,解锁无限可能

OpenAI 2025 年推出的 GPT - 4o 结合图像与语言能力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型能完成理解、生成与编辑任务,介绍了其架构、训练过程和应用。

CourseAI
算法论文8

X上63万人围观的Traning-Free GRPO:把GRPO搬进上下文空间学习

年初 DeepSeek - R1带火大模型强化学习,GRPO成常见RL算法,但训练成本高。腾讯优图论文提出Training - Free GRPO,将GRPO训练范式迁移到上下文学习,成本低、泛化好,已开源。

机器之心
开源动态8

HeyGen 开源了一个"用 HTML 写视频"的框架,我研究了一下,发现事情没那么简单

HeyGen 开源了 Hyperframes 项目,可让 AI 用 HTML 写视频。文章其定义、上手教程、竞品对比等方面展开,指出它虽有短板,但代表视频制作新范式,建议相关业者关注尝试。

AI Reading Hub
新闻资讯8

“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026

WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。

InfoQ
算法论文8

少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。

机器之心
算法论文8

1052篇文献!上海AI Lab发布科学LLM综述:数据基础到Agent前沿

上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。

PaperAgent
开源动态8

OpenAI 迈出关键一步:LLM 黑盒不再是盲盒

OpenAI开源新研究成果,提出全新范式,训练权重稀疏的Transformer模型以提取人类可理解的电路。该方法分三步,关键结果显示稀疏模型优势多,但也存在训练成本高、规模有限等局限,还给出两条未来路线。

PaperAgent
算法论文8

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软和 UIUC 合作研究 StudentSim,基于真实学生数据训练个性化学生模拟器框架,解决了过去学生建模方法的问题。它经两阶段训练,在多领域实验中表现出色,还能为 AI 教师优化提供反馈。

机器之心