科技前沿

  • AI产品意图识别:从“调个大模型”到系统工程的认知跃迁

    AI产品意图识别:从“调个大模型”到系统工程的认知跃迁blockquote p 意图识别正成为 AI 产品的关键命门 但 90 的团队都在用错误方式对待它 从通用聊天机器人到功能型 AI 意图识别从不是简单的 Prompt 工程 而是决定产品生死的地基设计 本文将揭示分层意图架构如何同时解决响应速度 准确性与成本控制三大痛点 并给出产品经理必须掌握的三大决策原则与实战方法论 p 做 AI 产品这两年 blockquote

    2026-04-20 08:27:20
    27
  • 2026年Anthropic发布Claude Design:AI视觉创作工具引领设计新时代

    Anthropic发布Claude Design:AI视觉创作工具引领设计新时代p 在人工智能迅猛发展的时代 Anthropic 于 2026 年周五正式推出了其全新的 AI 视觉创作工具 Claude Design 这一创新产品标志着 Anthropic 在视觉设计领域的战略扩展 旨在将其强大的 AI 文本生成能力延伸至设计 原型制作 演示文稿等视觉创作场景 从而与市场上已有的设计工具如 Canva 和 Figma 展开直接竞争 p

    2026-04-20 08:28:19
    29
  • 如何实现 Claude Code 和 Codex 等 Agent CLI 的自动重试

    如何实现 Claude Code 和 Codex 等 Agent CLI 的自动重试自动重试这个词 看着像是个小开关 真落到工程现场里 完全不是那么回事 全民制作人们大家好 我是 HagiCode 制作人俞坤 今天这篇我们不聊空话 就聊 Claude Code Codex 这类 Agent CLI 的自动重试到底该怎么做 才能既接得住异常 又不把系统带进无休止的重复执行里 如果你最近也在折腾 AI 编程 那这类问题你大概率已经碰到过了 任务不是一上来就挂 而是跑到一半断掉

    2026-04-20 08:29:19
    31
  • 2026年GLM-4.7-Flash效果评测:在美赛数学建模题目中的应用表现

    GLM-4.7-Flash效果评测:在美赛数学建模题目中的应用表现数学建模竞赛一直是检验 AI 模型逻辑推理和问题解决能力的重要试金石 最近发布的 GLM 4 7 Flash 作为 30B 参数级别的轻量级模型 在多项基准测试中展现出了令人印象深刻的性能 特别是在 AIME 数学推理测试中获得了 91 6 分的高分 这让我们对它在美赛数学建模题目中的表现产生了浓厚兴趣 本文将通过对实际美赛题目的测试 全面评估 GLM 4

    2026-04-20 08:30:21
    31
  • 2026年告别感性测试:大语言模型评估 (Evals) 实战指南

    告别感性测试:大语言模型评估 (Evals) 实战指南大多数 AI 演示在周五下午看起来都很完美 你尝试了五个提示词 模型回答得很流畅 摘要简洁明了 聊天机器人听起来也非常专业 无论你是在构建一个从 PDF 中提取字段的工作流 还是在开发一个客户支持助手 最初的成功往往会让团队里的某个人说 这基本上可以发布了 然而 当真实用户到来时 情况发生了变化 他们输入混乱的信息 提出含糊不清的问题 上传格式诡异的文档 他们使用公司内部黑话

    2026-04-20 08:31:20
    30
  • 零基础部署Qwen3-14B:RTX 4090D+一键脚本,小白也能搞定

    零基础部署Qwen3-14B:RTX 4090D+一键脚本,小白也能搞定在 AI 大模型应用日益普及的今天 私有化部署已成为企业保护数据安全 提升响应速度的首选方案 Qwen3 14B 作为通义千问推出的 140 亿参数大语言模型 具备 32K 长上下文支持和原生函数调用能力 特别适合需要处理复杂任务的中等规模商用场景 但对于大多数开发者来说 大模型部署面临三大难题 环境配置复杂

    2026-04-20 08:32:18
    28
  • 2026年夜天之书 119 Agentic Coding 的边界

    夜天之书 119 Agentic Coding 的边界本文结合我近期 Agentic Coding 的经验 讨论这一范式在实践当中可能遇到的问题 首先说明 以目前 LLM AI 的能力 能够针对任意通用任务生成疑似正确 Plausible 的方案 流程或代码等 是完全可以做到的 但是以此为由声称 某某领域已死 1 则大可不必 因为从生成似是而非的原型 到实际经得起考验的产品 仍然存在 AI 不能覆盖的鸿沟 不过 如果你的需求并不复杂

    2026-04-20 08:33:20
    33
  • 2026年GLM-4-9B-Chat-1M显存优化指南:40GB GPU高效运行技巧

    GLM-4-9B-Chat-1M显存优化指南:40GB GPU高效运行技巧最近在用 GLM 4 9B Chat 1M 这个模型的时候 我发现一个挺实际的问题 虽然官方说支持 100 万 token 的上下文长度 但真要用到 40GB 显存的 GPU 上跑 动不动就显存不够用 这就像是你买了个大房子 结果发现家具太多还是放不下 其实这个问题很常见 很多人在部署这个大模型时都会遇到

    2026-04-20 08:34:18
    28
  • 2026年GLM-Image GPU算力适配方案:A10/A100/V100多卡并行推理部署实操记录

    GLM-Image GPU算力适配方案:A10/A100/V100多卡并行推理部署实操记录本资源是一套专为 Claude Code 打造的分层式 AI 编程规范集 采用 通用原则 语言专属 的双层结构设计 覆盖 TypeScript Python Go Web Swift PHP 等主流技术栈 核心内容包含 通用开发规则 定义适用于所有项目的代码风格 Git 工作流 测试 性能 安全等通用标准 语言专属规范 在通用规则基础上 补充各语言 技术栈的惯用写法

    2026-04-20 08:35:23
    30
  • 2026年多云时代AI Agent治理挑战与Agent Registry预览版解决方案

    多云时代AI Agent治理挑战与Agent Registry预览版解决方案gt 摘要 gt 在多云时代 AI Agent 的快速部署与跨平台运行加剧了智能体扩散风险 为企业 AI 治理带来严峻挑战 为系统化管控 Agent 生命周期 保障合规性与可追溯性 业界正式推出 Agent Registry 预览版 该注册中心支持统一登记 元数据管理与权限审计 是构建企业级 AI 治理基础设施的关键一步 gt 关键词 gt

    2026-04-20 08:36:21
    29