跑分造假」共找到 844 篇相关文章

产品应用8

一句话搭出9人旅行网站!奥特曼:ChatGPT Work名字起小了

7月26日深夜,奥特曼称用手机让ChatGPT安排长周末旅行,指令完了。ChatGPT Work能力强,能处理多种任务,横跨检索、建站等活儿。其底层是Codex技术,有插件、Sites等能力,还能处理家务。

新智元
推荐文章7

AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?

《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 享理解代码方法。

特工宇宙
推荐文章7

我把斯坦福最火的一门课,做成了Prompt来帮我设计人生。

作者受《人生设计课》启发,将课程内容做成Prompt借助Claude辅助设计人生。此Prompt四阶段,经多轮对话生成蓝图,含现状、问题、计划等,还提及原型行动和失败免疫,多位同事使用后有新感悟。

数字生命卡兹克
产品应用7

Anthropic发布重大更新推出CC进化版Claude Tag,Karpathy:LLM第三次交互革命来了

Anthropic推出Claude Tag,是Claude Code进化版,更主动适合团队协作。有多人协作、持续学习等四大优势,权限频道隔离。Claude Enterprise和Team用户可在beta阶段用,Andrej Karpathy称是LLM第三次交互革命。

AI寒武纪
开源动态8

DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude

DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练三阶段,测试中表现出色,也存在局限。

AIGC开放社区
新闻资讯8

紧急警告:LiteLLM PyPI 包被植入恶意代码,请停止更新

月下载量9700万的Python库LiteLLM被黑客植入恶意代码,36%云环境或受影响。恶意代码三阶段,可窃取敏感信息。攻击源于供应链漏洞,黑客利用被盗凭证发布恶意版本。官方已采取措施,建议用户自查。

AGI Hunt
新闻资讯8

哈佛物理教授疯了:我让AI写论文,结果两周干完博士一年工作!已发顶刊

哈佛物理学教授Matthew Schwartz指导Claude 4.5,两周产出顶刊级量子场论论文,人类博士生则需一两年。实验中AI展现能力也暴露问题,教授总结其优缺点及应对心法,还探讨人类科研人员未来。

新智元
新闻资讯7

arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合

Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流大模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。

量子位
算法论文8

王兴兴署名,宇树机器人春晚之后又进化了:单个策略就能学习各种极限动作

春晚上,宇树机器人展现高动态、高协同的全自主集群控制技术。现在,多机构提出 OmniXtreme 通用策略,可执行各种极限动作。该框架两阶段,经测试在仿真和现实中表现出色,打破了泛化壁垒。

机器之心
推荐文章7

Vibe Coding 在代码生成与协作中的实践与思考

本文整理自阿里专家向邦宇的享。探讨构建 Vibe Coding 工具,介绍其类、在阿里现状。指出用户使用中面临代码质量等问题,产品自身有设计、安全挑战。还享 Agent 建设经验,强调适配国产模型及模板化的作用。

InfoQ