「GPT - 4」共找到 2131 篇相关文章
一个模型读懂所有医学数据,Hulu-Med探索医学大模型开源新范式 | 浙大x上交xUIUC
Hulu - Med是浙大、上交、UIUC等联合提出的通用医学视觉语言大模型,首次在单一模型统一理解医学多类数据。它开源透明,训练成本低,性能媲美GPT - 4.1,为医学AI带来新范式。
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。
AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。
作者和同事测试AI色盲测试图,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看图断章取义,缺乏人类的“格式塔”能力。
Transformers v5 中的分词系统:更简洁、更清晰、更模块化
文章聚焦 Transformers v5 分词系统,介绍分词概念、流程、主流算法,对比 transformers 和 tokenizers 库。着重讲 v5 改进,如架构与词表分离,解决 v4 黑盒问题,还能从零训练专属分词器。
快手在 AI 上,渐入佳境
文章介绍快手多模态大模型 Keye-VL 1.5,参数 8B 适合中小企业。它侧重短视频场景,视频理解能力强,能与业务结合,提升推荐等场景效率。还详述其架构、预训练、后训练及训练架构优化等技术细节。
Meta 再挖角4名OpenAI 华人研究员!网友:希望给的钱不要比Yann LeCun 多……
The Information报道,Meta再从OpenAI挖走四名关键华人研究员,这是第二波挖角。此前Meta刚斥巨资收购股份并挖来华裔CEO。此次挖角引发各方反应,也凸显AI人才竞争激烈。
ACL2025 | 代码助手火了,但安全吗?所有模型评估结果都很扎心
近期,GitHub Copilot、ChatGPT等AI代码生成工具爆火,效率显著提升,但代码安全性存疑。北大团队用CoV-Eval评测20款主流大模型,结果不佳,论文还给出优化方向,呼吁代码上线前严格测试。
ChatGPT语音杀入桌面!你负责动嘴,一群AI负责干活
近日OpenAI将ChatGPT语音功能正式引入桌面版,其底层是新一代语音模型GPT - Live。大佬们看好语音输入,因其能高带宽传递上下文。该功能不仅能闲聊,还可调度智能体,OpenAI想让ChatGPT成AI工作操作系统。
黄仁勋祭出DLSS 5!AI画质追平好莱坞,国产游戏抢占全球C位
NVIDIA GTC 2026大会上,黄仁勋推出DLSS 5,称这是图形领域的「GPT时刻」。它解决了让游戏画面逼近好莱坞电影级视觉效果的难题,靠实时神经网络渲染注入写实光照与材质效果,首发游戏国产近半,今年秋季推出。
当 Kanban 不再管理人:Routa Kanban 如何管理 Agent Team
本文探讨了 Routa Kanban 如何管理 Agent Team,指出在 AI4SE 时代,多 Agent 协作进入日常软件交付需建设管理界面与工程护栏。Routa Kanban 把多 Agent 协作推进到‘管理驱动’,其价值在于将隐性约束显性化。