新版图灵测试」共找到 4967 篇相关文章

产品应用9

Jev 是个什么模型?它一个字都不生成,为什么还这么火?

本文深度解析TypeSafe AI发布的Jev模型,该模型不生成文本,专注提供高速结构化概率判断,分析了其架构、训练、适用场景,探讨了对AI行业格局的影响,给出开发者实用判断标准。

AI Reading Hub
新闻资讯8

突发!Opus 5.2深夜上线,RSI真来了?

Anthropic在Claude Code开启Claude Opus 5.2灰度测试,跳开5.1版本,解决了以往AI“偷懒病”,响应速度、输出质量大幅提升,同时曝光内部已用核武级Model 2编写代码,RSI或已来临。

新智元
新闻资讯8

量子位编辑作者招聘

量子位是追踪AI进展的内容平台,现招聘AI产业、财经、产品方向编辑作者,岗位有主编、主笔、编辑。全职工作地点在北京中关村,社招、校招均有,有丰厚回报和成长机会。

量子位
产品应用8

最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成本降 45%,Anthropic 把顶级模型送进真实世界

当地时间9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,模型在多方面能力提升,Agent工作负载成本最高降45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。

InfoQ
新闻资讯8

从海外断供到全国产闭环,安世中国做对了什么?

安世中国在2025年9月30日遭海外断供晶圆后,于次年8月23日品全球发布会公开亮相。其从组织、供应链、研发、渠道四方面重构,取得12英寸量产等成果,还给出未来路线图,有重大产业意义。

芯师爷
开源动态8

超硬核,腾讯给力!

文章介绍腾讯朱雀实验室开发的AI安全红队测试平台A.I.G,能对AI系统做全面“安全体检”,覆盖AI基础设施、MCP、LLM等风险。它功能实用,安装简单,适合折腾AI服务或MCP的人。

开源先锋
新闻资讯8

腾讯递来了,这个秋天的第一张 AI 船票

腾讯2027届「AI产品经理培训生」岗位开始投递,公开选拔流程与用人要求。选拔不看学历标签,设流程重实际表现。对人才要求贴合AI产品工作,培养体系成熟,岗位含金量高,值得应届生尝试。

AGI Hunt
开源动态7

告别 LEB128 的规范性陷阱,Bijou64 用结构设计解决安全问题

研究实验室Ink & Switch发布bijou64可变长度整数编码格式,由Brooklyn Zelenka开发。它消除规范性漏洞,在基准测试中超标准标量LEB128解码器。Hacker News社区对其有权衡讨论,实现已用Rust发布。

InfoQ
算法论文7

做过十遍还要从头摸索?Agent 的记忆终于开始长成技能

MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。

深度学习自然语言处理
产品应用7

Claude Sonnet 5:更强,但更贵,每任务成本反超Opus 4.8

Anthropic 发布的 Claude Sonnet 5 智能指数追平 GPT - 5.5,但每任务成本比 Opus 4.8 贵 15%。它在知识工作类任务表现佳,推出促销价,不过促销后成本待察。评估迁移时需算 token 消耗。

AI工程化