Coding测试」共找到 2568 篇相关文章

新闻资讯8

OpenAI还在讨论“异星心智”,乐享科技已经造出来了|甲子光年

本文对比OpenAI对异星机器心智的风险预警,介绍中国乐享科技基于仿生神经科学思路,研发出面向机器人的以太大模型,已完成多场景验证,将举办户外开放直播测试,探索具身智能新路线

甲子光年
算法论文9

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

上海交大与上海AI实验室团队的研究,针对当前具身智能依赖理想化环境与指令假设的痛点,提出REAL框架,统一主动探索、意图消歧与执行为闭环,支持零样本迁移至真机,已开源代码并被ECCV 2026接收。

机器之心
开源动态8

能识图、看视频,也能理解软件界面:蚂蚁百灵开源Ling-3.0-flash-VL

本文介绍蚂蚁百灵开源的多模态大模型Ling-3.0-flash-VL,该模型采用稀疏混合专家架构,支持图片、视频、软件界面理解,可将视觉信息用于推理与任务执行,开放权重采用MIT许可证供开发者部署测试

AIGC开放社区
产品应用7

2个设置,让Codex体验翻倍

文章分享两个提升Codex使用体验的技巧。一是在config.toml里添加配置,让非计划模式能主动提问;二是用特定提示词测试gpt的juice值,选正常思考程度的模型使用,提升使用心情。

探索AGI
推荐文章8

1周半写64个PR、完成30%项目重构:一家成熟SaaS公司把Agent塞进研发全流程后

Calendly公开Agentic Engineering实践,Agent嵌入研发全流程,如审查需求、写代码、测试等。一周半内,Agent为IAM团队生成64个PR,完成30%项目重构。研发瓶颈从写代码转为判断力,强调好需求与护栏重要性。

InfoQ
新闻资讯7

Zig 创始人直言,Bun 靠 Claude 生成的 Rust 重构版是“没人把关的烂代码”

Bun创建者用Claude智能体11天将Bun从Zig移植到Rust,虽通过测试,但Zig创始人Andrew Kelley批评其编程实践不规范,认为代码是‘没人把关的烂代码’,且AI生成代码缺监督会出问题。

InfoQ
新闻资讯7

2026 Data+AI 中场纪实:企业决策者,敢把真实业务交给 Agent 吗?| 直播预告

Snowflake携手InfoQ发起直播,探讨企业将真实业务交予Agent的问题。贾天下将分享相关内容,其博客展示有本体团队可实现的能力,还通过生物医学基准测试比较不同方案,为构建企业级AI智能体提供参考。

InfoQ
开源动态8

真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????

文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持多模型,有任务流程和多Agent协作功能,还分析适用人群并给出启动方法。

小华同学ai
产品应用8

Claude Fable 5怎么用?Anthropic 工程师:干你也不知道的事

Anthropic的Claude Code工程师Thariq Shihipar发长文介绍Fable 5使用方法。他认为与Fable 5协作要发现未知,其定位解决复杂问题。还将未知分类,给出任务前中后打法,并举例用Fable 5剪视频。

AIGC开放社区
产品应用7

Anthropic总想摔碎程序员饭碗,甩出了“以后只招两种人”名单。

昨天Anthropic发布新产品Claude Tag,被Karpathy赞为LLM交互第三范式。Claude Tag与之前的Claude Code远程插件有4方面差别。产品负责人Fiona Fung分享,Anthropic人均代码交付量剧增,招人只看两类人。

探索AGI