K3模型」共找到 8685 篇相关文章

算法论文7

代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相

新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。

新智元
产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI
新闻资讯7

今起Codex每天重置一次!Tibo义父:首次3小时后发放,重置时间可自选

今起付费却无法用GPT - 6 Astra的用户,每天能重置额度一次,首个额度不到3小时发放,可自选重置时间。还提到GPT - 6做长程任务超272K tokens部分不增额度消耗倍率,开放时间待定。此外介绍在其开放前可做的3件事。

量子位
产品应用8

LLM 技术在有道词典笔上的应用实践

本文围绕LLM技术在有道词典笔的应用展开。先分析端侧大模型落地挑战,如算力、功耗等。介绍有道词典笔等硬件及应用,对比端侧与云侧AI优劣。还阐述模型落地模式、算法优化及“子曰3数学模型”开源情况。

InfoQ
产品应用7

刚刚,DeepSeek-V3.1「终极版」重磅发布!最大提升超36%,V4/R2还远吗?

DeepSeek最新模型DeepSeek-V3.1-Terminus发布,解决了此前输出随机带「极」字、中英文混杂等问题,在多个基准测试中成绩提升,最大提升超36%,Agent能力也有进步,还引发网友对V4/R2的期待。

新智元
产品应用9

基于 Qwen3.8-Max 构建 AI 合同精审系统:文档解析、多轮条款分析 Pipeline 工程实战

本文分享基于Qwen3.8-Max大模型+Python Flask搭建AI合同精审系统的完整工程实战,包含环境配置、项目架构、核心模块开发,记录开发踩坑经验,附AI与人工审查的实测对比数据,适合中小企业合同初审使用。

机器学习AI算法工程
新闻资讯7

谷歌突砍Gemini免费版炸锅,数据养模遭背刺?GPT-5.2突袭Gemini 3,Demis Hassabis:谷歌须占最强位

近日谷歌收紧Gemini API免费层级限制,引发开发者不满。同时,OpenAI计划提前发布GPT - 5.2竞争。谷歌DeepMind的Hassabis表示要与OpenAI竞争到底,对Gemini 3满意,还介绍了谷歌未来三个主打方向。

InfoQ
新闻资讯7

GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3

新智元报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更多算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。

新智元
新闻资讯7

千问模型预览版杀到全球第6,马斯克称中国将赢得地球上的AI竞赛!

LMArena更新榜单,阿里千问新旗舰预览版获1464分,全球排第六、中国第一。阿里在全球大模型实验室排第五,全球前十中有五家中国公司。千问3.5预览版表现出色,正式版值得期待。

探索AGI
7

谷歌突砍Gemini免费版炸锅,数据养模遭背刺?GPT-5.2突袭Gemini 3,Demis Hassabis:谷歌须占最强位

近日谷歌收紧Gemini API免费层级限制,引发开发者不满。与此同时,OpenAI计划提前发布GPT - 5.2应战。Google DeepMind CEO Demis Hassabis表示谷歌要占最强位,对Gemini 3满意,还介绍了谷歌未来三个发力方向。

AI前线