「代码能力评测」共找到 4920 篇相关文章

新闻资讯8

协和4+4的另一面:浙江范式用AI定义医疗未来!AI「智愈」时代来临

一场关于协和“4+4”的热议引发医疗未来之问,浙江从医院、企业、政府三重维度,以浙大二院、德适生物、安诊儿等为例,展示AI在医疗领域的应用,构建未来医疗图景,推动医疗从“治病”走向“智愈”。

新智元
新闻资讯8

2025年4月17日消息,OpenAI 连发o3和o4 mini,o3为强大推理模型,o4-mini专为高效推理优化。它们能调用ChatGPT工具,可基于图像思考。OpenAI还开源本地代码智能体Codex CLI,兼容所有模型。

鱼羊
新闻资讯9

1000 万悬赏生活类智能体!支付宝正亲手把未来 10 年的商业入口交给独立开发者

本文报道支付宝在2026外滩大会宣布,每年投入1000万元设立「智能体涌现奖」悬赏生活类AI智能体,开放自身支付、流量、风控等生态能力,助力独立开发者落地真实需求、实现商业闭环,抢滩智能体商业新入口。

特工宇宙
推荐文章9

基础杂活全被一键秒杀,还要初级员工干嘛?Google Research负责人:以往熬15年的判断力,现在一出道就得硬抗

本文为Google Research全球研发副总裁Yossi Matias的官方播客访谈,分享了Google在生成式AI、AI加速科研、行星级智能、量子计算等前沿方向的探索,探讨AI替代基础工作后对人才能力要求的变革。

AI科技大本营
开源动态9

告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」

当前大语言模型长期记忆方案均基于相似度检索,存在结构性盲区,无法在无字面/语义相似时召回关联记忆。腾讯团队提出T-Mem,实现AI联想回忆,已被EMNLP 2026接收,代码开源并上线QQ AI伙伴。

机器之心
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步是可验证,结果层才是真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park
新闻资讯7

突发!Hugging Face 要被卖了:最新报价约870亿元

重要AI开源平台Hugging Face正探索出售,估值或达130亿美元。消息引发对开源生态的担忧,此前微软收购GitHub就曾让部分人迁移代码。它从聊天机器人转型,近年还扩张到硬件等领域。

新智元
产品应用7

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

过去大模型生成的游戏虽代码能跑,但常陷入“可玩性黑洞”。Spellcaster让多个专用Agent协同处理,形成“生成—运行—检查—修复”循环。目前能快速生成多种游戏原型,未来将用世界模型直接生成画面。

量子位
新闻资讯7

上周 GPT 和 Codex 各有一个发布,很多人没注意吗?可以解锁 Codex 百万上下文了

最近基模发布多,OpenAI 俩更新被低估忽略。一是 GPT - 5.6 Sol 的 Ultrafast 模式,输出最高达每秒 750 Token,先向少量 API 客户开放;二是 Codex 为其开放百万上下文能力,不过大窗口有代价。

MacTalk
开源动态7

Meta 开源 Brain2Qwerty v2:非侵入式脑机接口语句解码准确率达到 61%

Meta 近日开源非侵入式脑机接口系统 Brain2Qwerty v2,能将人脑想法解码为完整语句,平均单词识别准确率达 61%,远超其他非侵入式方案。其采用三阶段深度学习模型,代码和训练数据已公开。

InfoQ