「协作评估」共找到 1193 篇相关文章
OpenAI诈骗?GPT-4.1正式上线ChatGPT,网友实测却大呼失望
OpenAI官宣GPT - 4.1在ChatGPT中可用,Plus、Pro和Team用户可访问。它擅长编码和遵循指令,评估表现有优有劣。实测代码处理表现佳,但网友因无100万上下文窗口API版本而失望。
斩获22K star!再见重复劳动,微软AI开源智能办公机器人来了!抓紧用起来
微软推出视觉自动化神器`OmniParser`,上线GitHub获22K star。它重新定义人机协作,有三大能力、五大自动化杀手锏,适用于六大实战场景,还给出速成指南,与同类方案相比优势明显,正重塑办公范式。
AI长身体,直接做实验!自主通用科学家,科研界的Scaling Law来了
本文探讨未来科研范式「自主通用科学家」(AGS),它将AI与机器人技术结合实现科研全流程自动化,有望突破人类科研限制,引发科学范式变革,还介绍了相关架构、优势及面临的挑战和应对策略。
真狠!4 万 Star CodeWhale,AI 写代码最怕的是什么????
文章介绍开源的CodeWhale,它是terminal coding agent harness,GitHub超4万Star。它给代码Agent定规则,涵盖身份、证据等原则。支持多模型,有任务流程和多Agent协作功能,还分析适用人群并给出启动方法。
相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么
文章围绕 Agent Protocol 展开,指出框架更迭但生产级 Agent 系统问题不变。以 Agent Protocol 为主线拆分 Agent Runtime,探讨其核心、稳定对象、执行模型等,还对比各框架在多维度的表现并给出设计建议。
分享10本我觉得AI时代应该必读的好书。
作者推荐10本非AI直接相关但对理解和学习AI有用的书,如《失控》助理解AI本质,《人有人的用处》探讨人机关系,《系统之美》揭示AI使用代价等,这些书构成AI时代底层方法论。
Kimi总裁张予彤北大实录:我们想要有抽象能力和偏执的人|甲子光年
Kimi总裁张予彤在北大分享,谈AI时代人才标准,偏好有抽象能力和偏执的人。还探讨AI创造新工作、学校课程设计、企业管理等问题,分享Kimi招人标准、组织特点及对行业诸多问题的看法。
回敬 Codex,Claude Code 推出 /goal 功能,不干完不睡觉
Claude Code随2.1.139版本推出 `/goal` 命令,设定完成条件后可持续工作至目标达成。它与Codex互相借鉴功能,且在设计上采用裁判分离,官方也给出目标制定建议,还带来其他更新。
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
“别急着裁底层,很多高管才最该被 AI 接管?”
文章围绕AI在企业中的应用展开,探讨AI预算分配、build vs buy、岗位替代等问题。指出AI预算将按人分配,建东西变便宜但有瓶颈,高层瓶颈更适合先被AI优化,代码审查或成高风险环节。