「智能测试用例生成系统」共找到 4882 篇相关文章

产品应用8

2.12页/秒,MinerU2.5太快了,1.2B硬刚腾讯、阿里

GPT - 4o等刷新OCR榜单,但产业界仍面临文档图像处理难题。MinerU2.5提出1.2B轻量级文档解析模型,采用创新解耦范式,在多基准测试表现出色,单卡吞吐快,还给出可借鉴创新点。

CourseAI
新闻资讯7

刚刚!软银系创始人4个月打造机器人超级黑马,获2轮近亿元融资

9月23日,成立仅四个多月的具身智能机器人企业浩海星空,获浙江仙通4000万战略投资。其创始人齐建伟有二十年技术积累,浩海星空精准卡位,选教育等场景破局,还前瞻布局双足人形机器人。

新智元
8

ChatGPT新功能Pulse,GPT-5主动给你推消息,大家玩得停不下来

本周五凌晨,OpenAI 向 Pro 订阅用户开放 ChatGPT 新功能「Pulse」预览版。它基于智能体,会根据用户信息提供个性化更新,还能异步搜索。用户可管理研究内容、提搜索请求及反馈,未来或推广告、建社交网络。

机器之心
8

AI正在埋葬整个互联网的商业模式!

AI正改写全球网站流量格局,让传统流量模式失效,广告收入蒸发。它带来新规则,如智能体即买手、决策即交易等。企业应将产品服务塞入AI对话路径,普通人也可凭信任溢价等不被碾压。

MCP Server
推荐文章8

AI三问:Agent、LLM、RAG,一文厘清!

文章介绍大语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。

MCP Lab
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
新闻资讯7

Meta与Scale AI合作出现问题

Techcrunch消息,Meta向Scale AI投资143亿美元并招揽其高管运营超智能实验室,合作仅两月就出问题。人事有变动,TBD Labs与Scale AI对手合作,有人认为其数据质量低,Meta否认,投资开局或不利。

AIGC开放社区
推荐文章7

将 AI 注入 Java 应用程序

文章围绕将 AI 注入 Java 应用程序展开,以宇宙飞船租赁应用的聊天机器人为例,介绍如何用 LangChain4j 和 Quarkus 等 Java 框架与大语言模型(LLM)交互,还提及流式响应、结构化输出等功能及相关概念。

InfoQ
新闻资讯7

深度揭秘OpenAI如何让GPT-5「技术性」超越Claude:悄悄跳过最难的23道题

OpenAI发布会上称GPT-5代码能力全球第一,其在SWE-bench Verified基准获74.9%通过率,略高于Claude Opus 4.1的74.5%。但OpenAI未做23道难题,若计入,GPT-5实际通过率或低于Claude。

新智元
新闻资讯7

GPT-5、Grok 4、o3 Pro都零分,史上最难AI评测基准换它了

AAI机构提出新基准FormulaOne,让GPT - 5、o3 Pro等前沿大模型集体得零分。该基准含220个图结构动态规划问题,分三类难度。测试结果显示,模型在深层及最深层难度表现差,引发关注。

机器之心