新能安」共找到 7771 篇相关文章

开源动态7

DeepSeek 模型 R1-0528 悄悄开源,与o3 相当,实测来了。

DeepSeek团队悄无声息地在Hugging Face上开源推理模型升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性与o3相当,实测表现不错。

AI进修生
新闻资讯8

深度讨论一轮模型发布:当智进入月更时代 | Best Ideas

近期全球模型迎来高密度发布期,Anthropic、OpenAI、腾讯、DeepSeek 等纷纷推出模型。文章复盘了 Opus 4.7、GPT - 5.5、DeepSeek V4 等模型实测体验,探讨架构变化、力边界与产业影响,还分析算力、token 价格等问题。

海外独角兽
算法论文8

LLM 仅靠自身就增强推理?SePT 给出简洁在线自训练范式

多数推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,提升推理力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用力,代码易迁移复现。

机器之心
新闻资讯7

苹果脑机接口技术曝光:用思想操作 iPhone,AI 直接代其“发声”?

苹果宣布与脑机接口公司 Synchron 合作,开发读取大脑信号的植入式设备,可将信号转化为操作指令。该技术尚处早期,对残障人士是重大进展,结合 AI 潜力巨大。

InfoQ
新闻资讯7

OpenAI 盲测模型不如 Nano Banana Pro?曝 Altman 要暂停 Sora,死磕 ChatGPT

近日,网友发现 Notion 或在测试 GPT - 5.2。OpenAI 盲测图像模型‘Chestnut’和‘Hazelnut’,结果接近 Nano Banana Pro,但生成图未获好评。Altman 调整战略,暂停 Sora 死磕 ChatGPT,本周将推 GPT - 5.2。

InfoQ
开源动态8

DeepSeek多模态范式:一张图压缩7056倍,思考力反超GPT和Claude

DeepSeek上线多模态并开源范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。

AIGC开放社区
开源动态8

SOP:具身智在线进化范式,为大规模真实世界部署而生

智元机器人具身研究中心提出SOP在线后训练系统,将VLA后训练重构为“在线、集群、并行”,可即插即用后训练算法。它有高效探索、缓解偏移等优势,实验显示提升性、效率,突破VLA瓶颈。

PaperAgent
产品应用8

告别复杂提示词!蚂蚁方式让AI自动理解你的个性化需求

蚂蚁通用人工智研究中心自然语言处理实验室提出AlignXplore方法,通过强化学习让AI从用户行为归纳偏好并动态更。该方法训练分两阶段,支持流式偏好推断,实验表现优异,是大模型个性化尝试。

量子位
算法论文8

数据邪修大法好:仅用文本数据就预训练多模态大模型

多模态大模型研发中,行业认为无图文对就无多模态力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,实现跨模态互换,降低成本。

量子位
开源动态8

Meta开源史上最强语音“基座模型”:一口气支持1600+种语言

Meta AI FAIR团队发布Omnilingual ASR模型套件,为超1600种语言提供自动语音识别力。它引入架构提升性,改变引入语言范式,还发布相关数据集和模型,与全球伙伴合作。

AI寒武纪