Go语言技术文章
-
- Embedding 向量归一化后应该用点积还是余弦相似度
- Embedding 已做 L2 归一化时,点积与余弦相似度在数学上等价,工程上通常优先点积以避免重复归一化;若输入状态不确定或链路混用,则应显式使用余弦并先统一预处理。
- 科技周边 · 人工智能 | 2星期前 | 103浏览 收藏
-
- CNCF 多信号根因分析为什么不能只看告警:时间、拓扑与证据链的落地边界
- CNCF 的近期实践把云原生根因分析拆成信号、时间和服务拓扑三个维度。本文用一条可落地的证据链说明,为什么不能只看告警,以及如何输出可验证的候选根因。
- 科技周边 · 业界新闻 | 2星期前 | 云原生 · 可观测性 · OpenTelemetry CNCF 多信号根因分析 云原生故障响应 239浏览 收藏
-
- 多家模型 API 参数各不相同:用 LiteLLM 虚拟 Key 做路由和配额隔离
- 用 LiteLLM Proxy 把多家模型收敛到统一入口,再通过虚拟 Key 做模型白名单、团队预算和速率限制,让客户端不用感知供应商差异。
- 科技周边 · 人工智能 | 2星期前 | 299浏览 收藏
-
- kube-apiserver 缓存重建阶段如何安排控制器重试:从 429 到恢复可观测性
- Kubernetes v1.37 将 watchcache 初始化保护逻辑稳定化。本文拆解 WATCH、GET、LIST 在缓存未就绪时的分流边界,并给出控制器退避与恢复验收方法。
- 科技周边 · 业界新闻 | 2星期前 | 447浏览 收藏
-
- CNCF 云原生构建标准化怎么验收:Buildpacks 的 OCI 镜像与供应链边界
- Cloud Native Buildpacks 已进入 CNCF 毕业项目行列,但平台团队仍要从 OCI 镜像、分层、SBOM 与 rebase 四个证据面验收构建供应链。
- 科技周边 · 业界新闻 | 2星期前 | 222浏览 收藏
-
- MCP 远程服务器授权为什么必须带 resource:OAuth 2.1 受众绑定的最小实现
- 远程 HTTP MCP 的 OAuth 授权不能只把 Bearer token 透传过去。客户端要以 MCP 服务器的 canonical URI 作为 resource,同时放入授权请求和令牌请求;服务端还要校验 token 是否确实签发给自己。本文用一个最小实现拆开这条受众绑定链路,并说明 401、403 与跨服务器误用的边界。
- 科技周边 · 人工智能 | 2星期前 | oauth · 人工智能 · mcp · resource MCP OAuth 2.1 RFC 8707 token audience 远程 MCP 123浏览 收藏
-
- MCP 无状态服务如何避免把业务会话塞回连接:句柄关联与请求级扩展设计
- MCP 2026-07-28 将协议层改为无状态,但业务仍可能有状态。本文用显式句柄、请求级路由、缓存范围和 Trace Context 拆解迁移边界。
- 科技周边 · 人工智能 | 2星期前 | 119浏览 收藏
-
- Kubernetes v1.37 watchcache 初始化为什么返回 429:控制面恢复时的请求洪峰边界
- Kubernetes v1.37 相关控制面恢复期间,watchcache 初始化可能让 WATCH 和部分 LIST 返回 429。本文按请求类型拆解分流边界,并给出用 /readyz、Retry-After 和 apiserver_request_total 验证恢复的方法。
- 科技周边 · 业界新闻 | 2星期前 | 云原生 · kubernetes · 故障排查 · 火绒流量防火墙 Kubernetes kube-apiserver WatchCache v1.37 API Priority and Fairness 183浏览 收藏
-
- Open Responses 的 agent loop 为什么不等于 Chat Completions:输入输出对象的迁移边界
- 从 messages、tool_calls 到 response.items,拆清 Open Responses 面向代理循环的输入输出对象变化,给出兼容层和最小验证方法。
- 科技周边 · 人工智能 | 2星期前 | API · 人工智能 · Responses API Open Responses agent loop Chat Completions 293浏览 收藏
-
- OpenTelemetry Entity Events 怎么补齐资源关系:从实体身份到可追踪变更
- OpenTelemetry 的 Entity Events 把主机、服务、进程和依赖关系变成可追踪的事件流。本文从一次资源拓扑查询失效的排查切入,拆解实体身份、双时间、关系数组与三类遥测信号的连接边界。
- 科技周边 · 业界新闻 | 2星期前 | 164浏览 收藏
-
- MCP Tasks 的异步结果怎么收口:任务句柄、轮询状态与恢复条件
- 围绕 MCP Tasks 的任务句柄、状态轮询、输入等待、终态取数和断线恢复,整理一套不依赖具体厂商编排的客户端处理边界。
- 科技周边 · 人工智能 | 2星期前 | 异步任务 · mcp · MCP Tasks io.modelcontextprotocol/tasks tasks/get tasks/update 260浏览 收藏
-
- MCP 无状态协议改造后哪些上下文要留下:会话移除与可缓存路由的边界
- MCP 2026-07-28 无状态改造移除了协议层会话,但业务状态仍需显式保存。文章用 basket_id、Mcp-Method、ttlMs、cacheScope 与 Trace Context 梳理迁移边界。
- 科技周边 · 人工智能 | 2星期前 | HTTP · mcp · 工程实践 · 智能体 MCP 无状态协议 Streamable HTTP 305浏览 收藏
-
- Gemini File Search 多模态检索怎么留证:media_id 与 page_numbers 的引用边界
- Gemini File Search 支持图片检索后,引用记录不能只保存回答文本。本文拆开 media_id、page_number 与 file_citation 的职责,给出一套可复查的多模态引用记录方法。
- 科技周边 · 人工智能 | 2星期前 | 多模态检索 Gemini File Search media_id page_number 377浏览 收藏
-
- Gemini API 隐式缓存怎么提高命中:公共前缀与 total_cached_tokens 核对法
- 说明 Gemini API 隐式缓存的启用范围、最低输入 token 门槛、公共前缀组织方式,以及如何用 usage.total_cached_tokens 核对命中。
- 科技周边 · 人工智能 | 2星期前 | gemini · Gemini API 隐式缓存 total_cached_tokens 398浏览 收藏
-
- Kubernetes 1.37 Pod Certificates 进入 GA:工作负载身份有哪些新边界
- Kubernetes 1.37 将 Pod Certificates 与 Cluster Trust Bundles 提升为稳定能力并默认开启。本文梳理 Kubelet、签发控制器和应用之间的职责,说明证书轮换、信任包热更新、subPath 与第三方签发器的适配边界。
- 科技周边 · 业界新闻 | 2星期前 | 云原生 · kubernetes · Kubernetes 1.37 Pod Certificates 工作负载身份 Cluster Trust Bundles 187浏览 收藏
查看更多
课程推荐
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- Golang深入理解GPM模型
- Golang深入理解GPM调度器模型及全场景分析,希望您看完这套视频有所收获;包括调度器的由来和分析、GMP模型简介、以及11个场景总结。
- 474次学习
查看更多
AI推荐
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 188次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 243次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 202次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 183次使用
-
- CMMLU
- 深入了解CMMLU中文评估基准,涵盖67个学科主题,提供数据集下载、Zero-shot/Five-shot评估方法及排行榜,助力优化中文语言模型性能。
- 174次使用

