「代码测试」共找到 3161 篇相关文章
谷歌2.5 Image:『你是我的神』,准备丢掉PS了
谷歌新出的大模型Gemini 2.5 Flash Image实现AI图像创作一致性、真实性新高度。它能理解手绘图表、解答问题及完成复杂编辑指令,可在Gemini和Google AI Studio免费使用,表现出色,有望取代很多PS任务。
DeepSeek 官宣V3.1:迈向 Agent 时代的第一步!
DeepSeek 官宣发布 V3.1,称这是迈向 Agent 时代第一步。其有混合推理模式,Agent 能力全面进化,API 也全面升级,支持 Anthropic API 格式。还继续开源,9 月 5 日起调整价格,社区反响热烈。
OpenAI联手谷歌,开源 agents.md,正式统一Agent规则!
OpenAI和Google等大厂联手推出 `AGENTS.md` 标准,旨在用统一文档取代厂家特定配置文件,为AI Agent提供通用‘项目说明书’。它收录AI完成任务所需技术细节,支持嵌套,还倒逼开发者规范文档协作。
只因太信ChatGPT,60岁男子三个月后险进精神病院...
美国《内科医学年鉴》刊登真实病例,60岁男子听ChatGPT建议用溴化钠代替食盐养生,致溴中毒,身心失控。医生实验发现ChatGPT回复缺健康警告,今年已有12起因信ChatGPT住院案例。
2025年多款Deep Research智能体框架全面对比
文章从 OpenAI 关于 DeepResearch 的指南入手,对多个开源深度研究智能体框架进行架构解构与功能对比,还体验了商业化智能体应用,为使用者和开发者选工具框架提供参考。
别听模型厂商的,Prompt 不是功能,是 bug
风险投资Conviction创始人Sarah Guo分享2025年AI创业观察,指出从用户体验看,prompt是缺陷非功能;传统低技术行业正快速拥抱AI;还分析了AI能力进展、应用案例及投资机会等。
技术狂飙下的 AI Assistant,离真正的 Jarvis 还有几层窗户纸?
随着AI技术进入新阶段,LLM面临新天花板,市场呼唤从「会聊天」迈向「能行动」的下一代AI Assistant。文章从智能规划与调用等维度分析其发展挑战,介绍不同技术路径并分析优劣势。
如何用AI Coding和Claude Code提升开发效率?看我的全流程复盘
作者分享用AI Coding和Claude Code提升开发效率的经验。先谈AI Coding,如Prompt工程心得、划分任务边界等;后讲Claude Code使用,包括安装、指令、构建项目规则等,还提及它在多场景的应用。
LeCun出手,造出视频世界模型,挑战英伟达COSMOS
训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。