leetcode 复健 1232. 缀点成线

给定一个整数数组 coordinates ,其中 coordinates[i] = [x, y] , [x, y] 表示横坐标为 x、纵坐标为 y 的点。请你来判断,这些点是否在该坐标系中属于同一条直线上。 示例 1: 输入:coordinates = [[1,2],[2,3],[3,4],[4,5],[5,6],[6,7]] 输出:true 示例 2: ...

September 8, 2026 · 1 min

leetcode 复健:54螺旋矩阵

说来感慨,大一那会儿这题都是有手就行的,现在手撕都费劲了,有个思路就了不得了。 给你一个 m 行 n 列的矩阵 matrix ,请按照 顺时针螺旋顺序 ,返回矩阵中的所有元素。 示例 1: ...

August 5, 2026 · 1 min

leetcode 复健:1041

在无限的平面上,机器人最初位于 (0, 0) 处,面朝北方。注意: 北方向 是y轴的正方向。 南方向 是y轴的负方向。 东方向 是x轴的正方向。 西方向 是x轴的负方向。 机器人可以接受下列三条指令之一: ...

August 1, 2026 · 3 min

Inagora 爬虫实习面试记录

一面: 面试问项目啥的直接跳过,说说问的技术问题: 浏览器里除了会保存 cookie 信息以外还会保存什么其他信息吗? 这个问题我当时答得磕磕绊绊的,只说了有个 local storage 然后还会保存一些 css 这种信息用来提高多次加载的速度以外没回答出什么。正常的回答如下: ...

August 1, 2026 · 6 min

pi agent 不显示 xhigh 和 max 的解决方法

最近开始使用 pi 的 coding agent,发现没法通过 shift+tab 来调整 effort level 到 xhigh 和 max,pi 的 settings 里也没有 让 pi 自己解决,很快就好了 直接把 thinkingLevelMap 放在模型对象下,并且在 max 键上也做映射(否则 max 级别不会出现): ...

July 28, 2026 · 1 min

Leetcode 复健2: 389

给定两个字符串 s 和 t ,它们只包含小写字母。 字符串 t 由字符串 s 随机重排,然后在随机位置添加一个字母。 请找出在 t 中被添加的字母。 示例 1: 输入:s = "abcd", t = "abcde" 输出:"e" 解释:'e' 是那个被添加的字母。 示例 2: ...

July 18, 2026 · 1 min

Leetcode 复健1: 1768

之前面一个中小厂不太顺利,回过头来发现我 vibe coding 太多导致基本的数据结构已经还给院长了,自己手写一个费劲的很,打算从 easy 难度的恢复一下,重走长征路 1768. 交替合并字符串 给你两个字符串 word1 和 word2 。请你从 word1 开始,通过交替添加字母来合并字符串。如果一个字符串比另一个字符串长,就将多出来的字母追加到合并后字符串的末尾。 ...

July 18, 2026 · 2 min

Z100 DCU 上 vLLM CUDA Graph 推理优化实践

我们在海光 Z100 DCU (gfx906) 上对 vLLM 推理框架的 CUDA Graph 功能进行了完整的测试验证。本文记录开启 CUDA Graph + torch.compile 的具体配置、性能数据和关键发现。 测试环境 项目 详情 服务器 scnet GPU 1x 海光 Z100 DCU (gfx906), 16 GiB Python 3.10.12 PyTorch 2.10.0+das.opt1.dtk2604 vLLM 0.18.1+das.3266200.dtk2604 Triton 3.4.0 模型 Qwen3.5-4B (BF16) 两种配置对比 Baseline:enforce_eager=True(禁用 CUDA Graph) compilation_config.mode = CompilationMode.NONE cudagraph_mode = CUDAGraphMode.NONE 启用 custom fusions(norm_quant、act_quant) 模型加载时间:~125s 显存占用:~13.25 GiB CUDA Graph + Compile:enforce_eager=False compilation_config.mode = VLLM_COMPILE(Inductor backend) cudagraph_mode = FULL_AND_PIECEWISE compile_ranges_endpoints: [8192] cudagraph_capture_sizes: [1, 2] 禁用 custom fusions(与 compile 不兼容) 模型加载时间:~172s(编译开销) 显存占用:~14.5 GiB(多出 ~1.3 GiB 用于 Graph 缓冲) 关键:CUDA Graph 模式不要传 –enforce-eager,去掉该参数后 vLLM 自动启用 VLLM_COMPILE + FULL_AND_PIECEWISE CUDA Graph。 ...

June 15, 2026 · 3 min

海光 Z100 DCU微基准测试:功耗、温度与计算特性分析

本文记录了我们使用自研微基准测试工具对 4× 海光 Z100 DCU 进行的一系列测试结果。 测试环境 项目 详情 GPU 4× 海光 Z100 DCU,每张 16GB,合计 64GB GPU 架构 gfx906 (Vega 20 / GCN 5.1) DTK 版本 DTK 26.04 (DCC2602-0317) PyTorch 2.10.0+das.opt1.dtk2604 测试工具 dcu_benchmark.py(基于 hy-smi 遥测采样) 采样间隔 1 秒 矩阵规模 4096 × 4096(Matmul 测试) 向量规模 64M 元素(Elementwise / 访存测试) 测试项目 我们使用 dcu_benchmark.py 在 4 张 Z100 上同时运行了以下 8 个微基准测试,每个测试持续约 20 秒,并在测试前后记录了空闲状态的基线数据: ...

June 9, 2026 · 7 min

海光 Z100 DCU 适配 vLLM 运行 Qwen3.5-27B 完整总结

环境信息 项目 详情 GPU 4× 海光 Z100 DCU,每张 16GB,合计 64GB GPU 架构 gfx906 (Vega 20 / GCN 5.1) DTK 版本 DTK 26.04 (DCC2602-0317) Python 3.10.12 PyTorch 2.10.0+das.opt1.dtk2604 vLLM 0.18.1+das.3266200.dtk2604 Triton 3.4.0(从源码编译,替换原 3.4.0+git1ef59765) transformers 5.5.0 flash_attn 2.8.3+das 上述镜像可以去海光社区:https://developer.sourcefind.cn/modelzoo/list/qwen3.5_vllm/detail?post_id=46176b42-0c0b-11f1-a49f-0242ac150003 获得 ...

June 8, 2026 · 6 min