结对编程」共找到 3076 篇相关文章

算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。

PaperAgent
新闻资讯7

OpenAI主攻速度的第一个模型来了:GPT‑5.3‑Codex‑Spark

OpenAI发布GPT-5.3-Codex-Spark,是GPT-5.3-Codex轻量级版本,也是首个为实时编程设计的模型。亮点是速度快,推理超每秒1000 token,已向ChatGPT Pro用户开放,后续规划融合两种工作模式。

AI寒武纪
新闻资讯7

最高500万!6个项目签约!“决战紫金之巅”圆满收官 | Q推荐

12月12日,决战紫金之巅——云谷杯・2025人工智能应用创新创业大赛总决赛暨闭幕式在云谷中心举办。活动聚焦AI应用创新及“AI+”融合,现场有政策宣介、圆桌谈等,6个项目签约,最高可获500万补贴。

InfoQ
新闻资讯7

ChatGPT大更新推出学习模式!“一夜之间1000个套壳应用又死了”

ChatGPT大更新,推出学习模式,像老师般引导思考,多类用户开放。它由OpenAI与多方合作打造,合学习科学成果。目前用提示词实现,未来会训练进模型,还将多方面改进,或重塑教育模式。

量子位
产品应用7

Claude 刚刚上线 “群聊Agent”:Karpathy盛赞的交互新范式,还是打工人的“数字监工”?

当地时间6月23日,Anthropic上线Claude Tag,可接入Slack用于多人协同办公。前OpenAI大神Karpathy盛赞其为交互新范式。不过它也引发隐私担忧,且“套壳产品”不利,或利好开源模型。

AI前线
新闻资讯7

5月5日5点55分,GPT-5.5自己选客人开派!Codex反超Claude Code

5月5日下午5:55,GPT - 5.5将举办派,时间自定,客人由Codex挑选。过去两月,AI编程工具圈开发者从Claude Code转向Codex。虽Claude模型强,但工具体感上Codex占优。

新智元
新闻资讯7

全球AI芯片被一家味精厂卡脖子?份额超95%,英伟达也得排队抢产能

AI芯片卡脖子节点藏在供应链深处,日本味之素作为全球AI芯片封装关键材料ABF近乎独家供应商,市场份额超95%。英伟达Rubin平台ABF需求大增,但味之素扩产受工艺良率制约。

新智元
新闻资讯7

Meta收购Manus最新进展:商务部介入,启动评估调查

2026年1月8日,中国商务部宣布会同相关部门Meta收购Manus案开展评估调查,审查其与出口管制等法律法规的一致性。此次调查或使交易走向审查通过、需补办手续、认定违规三种情形。

新智元
开源动态8

构化预处理让DeepSeek准确率提升51%,现已开源丨清华&深言

零成本降低大模型幻觉新方法LingoEDU,让DeepSeek准确率提升51%。它上下文精准切分,形成篇章构树。能解决现有方案两难困境,在多方面实验表现出色,有根治幻觉等核心价值。

量子位
开源动态8

智谱 GLM-4.7,Coding 开源第一,其他也很强

智谱正式发布并开源专为 Agentic Coding 打造的 GLM-4.7 模型,编程、推理、Agent 能力成绩亮眼,价格比 Claude Sonnet 4.5 更优。还推出 Coding Plan 套餐,使用方式多样。发布前几天,智谱港股招股书挂网。

AGI Hunt