Grok4.1」共找到 2987 篇相关文章

开源动态8

超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频大模型真香

小米推出MiMo - Audio大模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还集成TTS功能。

AIGC开放社区
产品应用8

2.12页/秒,MinerU2.5太快了,1.2B硬刚腾讯、阿里

GPT - 4o等刷新OCR榜单,但产业界仍面临文档图像处理难题。MinerU2.5提出1.2B轻量级文档解析模型,采用创新解耦范式,在多基准测试表现出色,单卡吞吐快,还给出可借鉴创新点。

CourseAI
新闻资讯8

仅4人28天!OpenAI首曝Sora内幕:85%代码竟由AI完成

OpenAI团队揭秘安卓版Sora APP构建内幕,4人团队28天完成从0搭建,约85%代码由AI智能体Codex完成。Codex可自我迭代,在多方面表现出色,但也需人类指导。团队分享了与Codex协作的经验和技巧。

新智元
新闻资讯7

Cyber天花板被打穿!AISI实测Mythos能力正以4.5月翻倍速冲向ASI

英国AI安全研究所(AISI)实测Anthropic的Mythos和OpenAI的GPT - 5.5,发现其网络攻防能力4.5个月就能翻倍,加速冲向ASI。Mythos在模拟企业内网32步渗透任务中表现出色,瓶颈在于Token而非智力。

新智元
新闻资讯8

8家国产芯无缝衔接DeepSeek-V4,中国AI算力生态的拐点来了!

4月24日DeepSeek-V4预览版发布,华为昇腾等八家国产AI芯片厂商同日完成全链路适配与性能优化。这得益于FlagOS开源软件栈,也因DeepSeek主动适配策略。后续竞争将转向软件生态完整度。

芯师爷
产品应用7

字节跳动Seed1.5-VL复杂图表精准抽取,Deep Think是多模态未来的主流

文章介绍字节跳动的Seed1.5-VL模型,它能精准抽取复杂图表,处理模糊图片、推理几何题。其由视觉编码器和LLM组成,预训练语料丰富,后训练结合多种方法,推荐在huggingface体验。

CourseAI
开源动态7

开源要变天了,刚刚,OpenAI开源gpt-oss-20/120b,o4-mini水平,主打Agentic

OpenAI正式开源gpt-oss模型,Anthropic推出Claude Opus 4.1,Google DeepMind发布Genie 3。gpt-oss有20B和120B两个版本,前者可在边缘设备运行,后者综合能力强,在多方面表现出色。

PaperAgent
8

半年4轮融资、总额5亿元!西湖大学教授押注具身智能「GPT时刻」

具身智能通用大脑公司西湖机器人半年完成4轮融资,总额5亿。其由顶尖团队创立,有先发技术优势,落地两项首创底层技术架构,打通技术链路,已拿下近亿元订单,将推动具身智能GPT时刻到来。

机器之心
算法论文8

ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理

现有视频虚拟试衣方法受限于固定相机视角,难以满足用户自由观察需求。本文提出 TryOnCrafter 框架,定义可控相机视频虚拟试衣任务,引入可渲染 4D 试衣代理,支持多种下游应用,为虚拟试衣开辟新路径。

机器之心
开源动态8

AI4S又一瓶颈被攻克:两个AI「吵架」,让科研代码部署成功率突破95%

科学软件大多难直接运行,制约AI4S与Agentic Science发展。Deploy - Master应运而生,是一站式自动化工作流。Search Agent筛选工具,Build Agent用双模型辩论机制使部署成功率超95%,为科学智能体交互打基础。

量子位