GPT-5.1 Pro」共找到 3687 篇相关文章

算法论文7

DeepSeek用的GRPO有那么特别吗?万字长文分析四篇精品论文

文章解读 Kimi k1.5、OpenReasonerZero、DAPO 和 Dr. GRPO 四篇论文,分析 DeepSeek R1 里 GRPO 及改进算法。指出 GRPO 非特殊 RL 算法,当前 RL 算法实现相似,变革聚焦价值函数取舍等核心维度。

机器之心
算法论文7

Auto Research最后一块拼图,Frontier-Eng Bench登场,在工程闭环里死磕最优

Einsia AI旗下Navers Lab论文Frontier - Eng推出新评测范式Generative Optimization,搭硬核评测系统,覆盖47个横跨5大工程方向的任务。评测多种模型,结果显示gpt 5.4最稳健,但距资深工程师水平尚远。

机器之心
推荐文章7

当前关于 Vibe Engineering 的所有认知都会在 1 个月内严重过时

作者分享 Vibe Engineering 实践体会,指出当前认知很快过时,因 AI 编程工具和模型进步大。还对比了 Opus 4.5、GPT - 5.2 等模型,阐述人在开发各阶段角色,介绍多 Agent 协同实践及未来软件公司组织形态变化。

InfoQ
开源动态8

3B小模型吊打72B巨头!轻量级文档解析OCR,性能超Gemini,高效且精准!

Yuliang - Liu团队在GitHub开源轻量级文档解析模型MonkeyOCR,以SRR三元组范式实现高效精准解析,3B参数模型在英文文档解析上超Gemini 2.5 Pro和Qwen2.5 - VL - 72B,还介绍了安装部署、适用场景等。

开源星探
新闻资讯7

李飞飞发布全新世界模型

李飞飞团队的World Labs发布两款新模型Marble 1.1和Marble 1.1 - Plus,能将平面照片转化为3D世界、提升画面清晰度。二者各有侧重,前者重画质优化,后者重空间生成,官方建议新用户从1.1开始用。

量子位
新闻资讯7

AI看不到的爱心,成了最棒的AI检测器。

作者以漂浮爱心图检测AI,Gemini 2.5 ProGPT - 5等模型均失败。又用噪点鹿视频测试,AI准确率为0%。原因是AI是空间王者、时间瞎子,无“共同命运法则”视觉系统,存在时间盲视。

数字生命卡兹克
新闻资讯7

4 个月 3000 万美金 ARR,做 AI 评测榜单的 LMArena 为何值 17 亿美金

AI评测产品LMArena半年前种子轮获1亿美金,现完成超1.5亿美金A轮融资,估值达17亿美金。其核心产品Chatbot Arena可对比AI模型回答并构建榜单,公布的数据或解答了其估值高的疑问。

投资实习所
开源动态7

不可思议!400B大模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。

机器之心
产品应用7

李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
新闻资讯8

I/O大会开完,谷歌连搜索框都变智能体了

当地时间周二谷歌I/O大会举行,转型智能体时代。谷歌推出Gemini 3.5系列模型,轻量级3.5 Flash已开放,重量级3.5 Pro仍在开发。还发布全新AI智能体Spark,改造谷歌搜索,推出多模态模型Gemini Omni。

机器之心