The speakers reflect on the initial release of Claude Code a year ago, noting it was not very good at first but has since evolved dramatically. They discuss how the tool has improved from simple tasks to handling complex agent workflows. The importance of letting Claude learn from mistakes by writing to a knowledge file rather than giving direct instructions is emphasized. Verification is highlighted as a key but often misunderstood concept, going beyond unit tests to include running the agent itself.
Các diễn giả suy ngẫm về bản phát hành đầu tiên của Claude Code cách đây một năm, lưu ý rằng ban đầu nó không tốt lắm nhưng đã phát triển vượt bậc kể từ đó. Họ thảo luận về cách công cụ đã cải thiện từ các tác vụ đơn giản đến xử lý các quy trình tác nhân phức tạp. Tầm quan trọng của việc để Claude học từ sai lầm bằng cách ghi vào tệp kiến thức thay vì đưa ra hướng dẫn trực tiếp được nhấn mạnh. Xác minh được nêu bật như một khái niệm quan trọng nhưng thường bị hiểu sai, vượt ra ngoài các bài kiểm tra đơn vị để bao gồm việc chạy chính tác nhân.
When we first released Quad Code, it was like a little video and I remember posting it to Slack and there was like two people that gave like the reaction like people were like excited.
Khi chúng tôi lần đầu phát hành Quad Code, nó giống như một video nhỏ và tôi nhớ đã đăng nó lên Slack và chỉ có khoảng hai người phản ứng như thể họ hào hứng.
I - thought it was really cool, especially for my very easy engineering tasks.
Tôi - nghĩ nó thực sự tuyệt, đặc biệt là cho các tác vụ kỹ thuật rất dễ dàng của tôi.
It was quite good at it.
Nó khá giỏi việc đó.
- That's like a really nice way to say that it wasn't really good.
- Đó là một cách nói khá hay để nói rằng nó không thực sự tốt.
I can't believe it's only been a year since we first launched Quad Code.
Tôi không thể tin rằng mới chỉ một năm kể từ khi chúng tôi ra mắt Quad Code.
- It's hard to remember what that was like.
- Thật khó để nhớ nó như thế nào.
Like it is it's so different than what we're doing today.
Nó khác xa so với những gì chúng tôi đang làm hôm nay.
Like now I just have like armies of agents that are doing stuff like I'm prompting one agent or I have like an agent that's like prompting agents that's prompting agents and it's like a tree of like thousands of agents.
Giờ tôi có cả đội quân agent đang làm việc, tôi đang nhắc một agent hoặc có một agent đang nhắc các agent khác và nó giống như một cây hàng ngàn agent.
But is I think it's just like the most important idea when working on
Nhưng tôi nghĩ ý tưởng quan trọng nhất khi làm việc với
this stuff is like every single time Quad makes a mistake, I don't tell Quad to do it differently.
Thứ này là mỗi khi Quad mắc lỗi, tôi không bảo Quad làm khác đi.
I tell it to write it to the quadmd or to like make a skill or something to do it differently.
Tôi bảo nó viết vào quadmd hoặc tạo một skill hay gì đó để làm khác đi.
And if you can do this, then quad can just like run forever.
Và nếu bạn làm được điều này, thì quad có thể chạy mãi mãi.
And I think the other thing that we kind of realized is the verification is really important.
Và tôi nghĩ điều khác chúng tôi nhận ra là việc xác minh rất quan trọng.
Like we didn't realize that.
Chúng tôi đã không nhận ra điều đó.
- I hear this come up a lot with developers and enterprises that we meet with.
- Tôi nghe điều này rất nhiều từ các nhà phát triển và doanh nghiệp chúng tôi gặp.
Um what are your tips for making a really good making quad code really good at verification?
Um, lời khuyên của bạn để làm cho quad code thực sự tốt trong việc xác minh là gì?
I sort of feel like this is this thing that just like everyone misunderstands because whenever we talk about verification, people are thinking like unit test or they're thinking like lint or like type check.
Tôi cảm thấy đây là thứ mà mọi người hiểu lầm vì khi nói về xác minh, người ta nghĩ đến unit test hoặc lint hoặc type check.
These are the things that are obviously really easy to automate and these are the things that were already automated.
Đây là những thứ rõ ràng rất dễ tự động hóa và đã được tự động hóa.
But actually when we talk about verification for agents, it's something slightly different.
Nhưng thực ra khi nói về xác minh cho agent, nó hơi khác một chút.
It's like can the agent run the thing?
Đó là liệu agent có thể chạy thứ đó không?
It takes a little bit of uh mental work to figure out how exactly do you do this cuz it's often not straightforward.
Cần một chút công sức tinh thần để tìm ra cách làm chính xác vì nó thường không đơn giản.
And I think that's like that's one of the challenges.
Và tôi nghĩ đó là một trong những thách thức.
I remember with uh with Opus 4, Claude tested itself and we we just like hooked it up to Opus 4 and I was like, "Claude, build a feature and then test yourself in like bash and it opened a little claude CLI and tested its own feature and I was just like whoa, it's crazy." Like now we're so used to it.
Tôi nhớ với Opus 4, Claude đã tự kiểm tra và chúng tôi chỉ kết nối nó với Opus 4 và tôi nói, "Claude, xây dựng một tính năng và tự kiểm tra trong bash" và nó mở một claude CLI nhỏ và tự kiểm tra tính năng của nó và tôi chỉ nghĩ "whoa, thật điên rồ." Giờ chúng ta đã quá quen.