The speaker explains that building trust in AI coding agents is essential for high productivity and parallelization. Trust grows over time, enabling agents to automerge PRs and achieve high velocity. Verification is the most critical skill: agents must run code, take traces, or test applications to close the feedback loop. Without verification, humans become bottlenecks, manually checking output and preventing scaling. The speaker compares managing agents to management: without trust, you micromanage and cannot parallelize.
Diễn giả giải thích rằng việc xây dựng niềm tin vào các tác nhân lập trình AI là điều thiết yếu để đạt năng suất cao và khả năng song song hóa. Niềm tin phát triển theo thời gian, cho phép các tác nhân tự động hợp nhất PR và đạt tốc độ cao. Xác minh là kỹ năng quan trọng nhất: các tác nhân phải chạy mã, lấy dấu vết hoặc kiểm thử ứng dụng để khép kín vòng phản hồi. Không có xác minh, con người trở thành nút thắt cổ chai, phải kiểm tra thủ công đầu ra và ngăn cản việc mở rộng quy mô. Diễn giả so sánh việc quản lý tác nhân với quản lý: không có niềm tin, bạn phải quản lý vi mô và không thể song song hóa.
So, the first thing I want to talk about, it's pretty serious, okay?
Vậy, điều đầu tiên tôi muốn nói đến, nó khá nghiêm túc, được chứ?
I need all of you to take this seriously.
Tôi cần tất cả các bạn coi trọng điều này.
Put your phones down, put your laptop down, put your water bottles down.
Đặt điện thoại xuống, đặt laptop xuống, đặt chai nước xuống.
We're done hydrating.
Chúng ta xong việc uống nước rồi.
Are you all ready?
Tất cả các bạn đã sẵn sàng chưa?
Very excited to announce.
Rất hào hứng để công bố.
applause Uh, you can't end PM insult yet.
[vỗ tay] Uh, bạn chưa thể kết thúc PM insult được.
We'll, we'll release that later today.
Chúng tôi sẽ, chúng tôi sẽ phát hành nó sau hôm nay.
Okay.
Được rồi.
So don't, don't take your laptops out.
Vậy đừng, đừng lấy laptop ra.
Um, but yes, very exciting milestone, and after I do the release, you can get started your applications by installing babel plugin react as well as the new eslint plugin.
Um, nhưng đúng, một cột mốc rất thú vị, và sau khi tôi thực hiện bản phát hành, các bạn có thể bắt đầu ứng dụng của mình bằng cách cài đặt babel plugin react cũng như eslint plugin mới.
Uh, okay, so I assume you can see my screen.
Uh, được rồi, tôi giả sử các bạn có thể thấy màn hình của tôi.
- Yes.
- Vâng.
Yeah, we're good.
Ừ, chúng ta ổn.
- So yeah, today, yeah, I think, I think the big theme for me as I've been using agents to write code and I'm sure a lot of you have had the same experience as well is how do you trust it?
- Vậy đúng, hôm nay, đúng, tôi nghĩ, tôi nghĩ chủ đề lớn đối với tôi khi tôi đã sử dụng agents để viết code và tôi chắc rằng nhiều bạn cũng có trải nghiệm tương tự là làm sao bạn tin tưởng nó?
You know, especially if you are an engineer that's been writing code for a very long time, you have a lot of opinions and lessons that you've learned about doing good engineering.
Bạn biết đấy, đặc biệt nếu bạn là một kỹ sư đã viết code trong một thời gian rất dài, bạn có rất nhiều quan điểm và bài học đã rút ra về việc làm kỹ thuật tốt.
And when you see agents
Và khi bạn thấy các agents
just, you know, winging it and, you know, guessing, hallucinating, uh, you know, confidently stating that they found the smoking gun, uh, for the hundth time, uh, but it's actually not the real problem.
Chỉ, bạn biết đấy, làm tùy hứng và, bạn biết đấy, đoán mò, ảo giác, uh, bạn biết đấy, tự tin tuyên bố rằng chúng đã tìm ra bằng chứng quyết định, uh, lần thứ một trăm, uh, nhưng thực ra đó không phải là vấn đề thật sự.
You lose a lot of trust.
Bạn mất rất nhiều niềm tin.
And when you lose, when you don't have much trust in your agents, I feel like you really can't get the most out of them.
Và khi bạn mất, khi bạn không có nhiều niềm tin vào các agents của mình, tôi cảm thấy bạn thực sự không thể khai thác tối đa chúng.
And for me, the parallel is
Và đối với tôi, sự tương đồng là
like with management.
Giống như với quản lý.
Uh, so if I'm an a manager, an engineering manager of a team and I have a bunch of, you know, I have a team of engineers, uh, on my team and I don't trust them, then the mode of operation I'm going to be in is going to be like micromanagement, right?
Uh, vậy nếu tôi là một quản lý, một engineering manager của một nhóm và tôi có một loạt, bạn biết đấy, tôi có một nhóm kỹ sư, uh, trong nhóm của tôi và tôi không tin tưởng họ, thì chế độ hoạt động tôi sẽ ở trong sẽ giống như micromanagement, đúng không?
I'll have to spend a lot of time looking over my reports' shoulders and checking that they're doing their work well, you know,
Tôi sẽ phải dành rất nhiều thời gian nhìn qua vai các báo cáo của mình và kiểm tra rằng họ đang làm việc tốt, bạn biết đấy,
like they're not shipping bugs to production.
Giống như họ không đưa bug lên production.
And so I drew this chart because, uh, it's not, it's not a very scientific chart, but like this is how I imagine myself and my journey through using agents.
Và vì vậy tôi đã vẽ biểu đồ này bởi vì, uh, nó không, nó không phải là một biểu đồ rất khoa học, nhưng đại loại đây là cách tôi hình dung bản thân và hành trình của mình qua việc sử dụng agents.
So, you know, like fast forward or back forward, uh, or fast back, uh, fast backwards like a year or so when, you know, nobody was or not many people were using agents to code.
Vậy, bạn biết đấy, giống như tua nhanh về phía trước hoặc tua ngược về phía trước, uh, hoặc tua nhanh về phía sau, uh, tua nhanh về phía sau khoảng một năm hoặc lâu hơn khi, bạn biết đấy, không ai hoặc không nhiều người đang sử dụng agents để code.
Uh, I think you, uh, you know, get into this mode where you are
Uh, tôi nghĩ bạn, uh, bạn biết đấy, bước vào chế độ này nơi bạn
in very heavily in the loop with one or several like a handful of agents and you find yourself just constantly figure, uh, you know, trying to understand what your agents are doing, uh, and you're very in loop.
Ở rất sâu trong vòng lặp với một hoặc vài, kiểu như một số ít agents và bạn thấy mình liên tục, uh, bạn biết đấy, cố gắng hiểu các agents của mình đang làm gì, uh, và bạn rất trong vòng lặp.
You're watching every single output.
Bạn đang xem từng output một.
You are sitting there prompting, um, and you really can't parallelize beyond that because you don't, again, you don't have that trust, right?
Bạn đang ngồi đó prompt, um, và bạn thực sự không thể song song hóa vượt ra ngoài đó bởi vì bạn không, một lần nữa, bạn không có niềm tin đó, đúng không?
You can't go
Bạn không thể đi
to a 100 agents, uh, like spawn 100 agents when you don't even trust the output of one agent.
Đến 100 agents, uh, kiểu như tạo ra 100 agents khi bạn thậm chí không tin tưởng output của một agent.
So over the past 5 months, I feel like I've really been able to, uh, like ascend this trust curve and now I'm at the point where, uh, I actually have this, sounds kind of scary to say this and it makes me sound like a slop artist, but I promise I'm not, but I actually have my agents now, um,
Vậy trong 5 tháng qua, tôi cảm thấy mình thực sự đã có thể, uh, kiểu như vượt lên đường cong niềm tin này và giờ tôi đang ở điểm mà, uh, tôi thực sự có cái này, nghe hơi đáng sợ khi nói điều này và nó khiến tôi nghe như một nghệ sĩ slop, nhưng tôi hứa tôi không phải vậy, nhưng tôi thực sự có các agents của mình bây giờ, um,
automerging PRs for me.
Tự động merge PR cho tôi.
Uh, which is like a wild thing to say, but, um, like I woke up today and there were like 20 PRs landed and I just reviewed them on main like they were already landed and they were good.
Uh, điều đó thật hoang đường khi nói ra, nhưng, um, kiểu như tôi thức dậy hôm nay và có khoảng 20 PR đã landed và tôi chỉ review chúng trên main như thể chúng đã được landed rồi và chúng tốt.
Uh, so how did I get to that point is basically what I wanted to talk about today.
Uh, vậy làm sao tôi đến được điểm đó về cơ bản là điều tôi muốn nói đến hôm nay.
Uh, and again, like, yeah, feel free to jump in if you have questions, Colin.
Uh, và một lần nữa, kiểu như, ừ, cứ thoải mái tham gia nếu bạn có câu hỏi, Colin.
Um, but, uh, oh yeah, of course I got to show this, this chart.
Um, nhưng, uh, ồ đúng rồi, tất nhiên tôi phải cho xem cái này, biểu đồ này.
Uh, where, uh, oh, do not trust to someone requested to control my computer.
Uh, ở đâu, uh, ồ, đừng tin tưởng vào ai đó yêu cầu điều khiển máy tính của tôi.
Uh, probably won't do that.
Uh, có lẽ sẽ không làm điều đó.
Uh, but yeah, so this chart, I think I'm, I'm sharing this chart not to kind of like flex but to kind of show like the journey, like so
Uh, nhưng đúng, vậy biểu đồ này, tôi nghĩ tôi, tôi chia sẻ biểu đồ này không phải để kiểu như khoe khoang mà để kiểu như cho thấy hành trình, kiểu như vậy
you can see like the curve, like it sort of like inversely matches the contributions I've been able to land at cursor.
Bạn có thể thấy kiểu như đường cong, nó kiểu như tương quan nghịch với các đóng góp tôi đã có thể landed tại cursor.
So I joined five months ago and five months ago, like I, you know, my first month I was like not very productive because I was ob, you know, I was learning the codebase, didn't know what the heck was going on, and as I got more confident in my agents, uh, I've really been able
Vậy tôi đã tham gia năm tháng trước và năm tháng trước, kiểu như tôi, bạn biết đấy, tháng đầu tiên của tôi tôi không năng suất lắm bởi vì tôi đang, bạn biết đấy, tôi đang học codebase, không biết chuyện quái gì đang diễn ra, và khi tôi trở nên tự tin hơn vào các agents của mình, uh, tôi thực sự đã có thể
to kind of ramp up my productivity.
Kiểu như tăng tốc năng suất của mình.
Uh, and again, like, yeah, like last month I shipped a thousand PRs, which is ridiculous.
Uh, và một lần nữa, kiểu như, ừ, tháng trước tôi đã ship một nghìn PR, điều đó thật vô lý.
Uh, and then this month we're only on the 12th.
Uh, và rồi tháng này chúng ta mới chỉ đến ngày 12.
I'm already at like almost 800 PRs landed.
Tôi đã gần như 800 PR landed rồi.
Uh, so the velocity is definitely high and you, I'm sure a lot of you will definitely be questioning like how much of this code is actually good.
Uh, vậy tốc độ chắc chắn là cao và bạn, tôi chắc rằng nhiều bạn chắc chắn sẽ đặt câu hỏi kiểu như có bao nhiêu code này thực sự tốt.
Um, and I think
Um, và tôi nghĩ
yeah, like that's definitely fair to question.
Ừ, kiểu như điều đó chắc chắn là hợp lý để đặt câu hỏi.
Um, but, uh, yeah, I think, I think if you set up your agents well, you can definitely get to a very similar level.
Ừm, nhưng, ừ, tôi nghĩ, tôi nghĩ nếu bạn thiết lập các agent của mình tốt, bạn chắc chắn có thể đạt đến một mức rất tương tự.
Um, and so I'm going to talk about how we do that.
Ừm, và vì vậy tôi sẽ nói về cách chúng tôi làm điều đó.
Uh, so for me, I think I'm curious, like, I guess, call in your experience as well, but, uh, for me, I think the most important skill that you should have in your toolbox when you work with agents is verification.
Ừ, vậy đối với tôi, tôi nghĩ tôi tò mò, kiểu như, tôi đoán, hãy gọi cả kinh nghiệm của bạn nữa, nhưng, ừ, đối với tôi, tôi nghĩ kỹ năng quan trọng nhất mà bạn nên có trong hộp công cụ của mình khi làm việc với agent là xác minh.
Uh, and by verification, I mean the ability for an agent to actually run the code, uh, or take CPU traces or heap snapshots or, uh, you know, open an iOS simulator, whatever, you know,
Ừ, và ý tôi là xác minh, khả năng để một agent thực sự chạy mã, ừ, hoặc lấy dấu vết CPU hoặc ảnh chụp heap hoặc, ừ, bạn biết đấy, mở trình mô phỏng iOS, bất cứ thứ gì, bạn biết đấy,
however your application is exposed to your users, it can do the same thing and, uh, run it for real and actually test and verify it don't work because that's the thing that really closes the loop.
Dù ứng dụng của bạn được hiển thị với người dùng như thế nào, nó có thể làm điều tương tự và, ừ, chạy nó thật sự và thực sự kiểm tra và xác minh nó không hoạt động bởi vì đó là thứ thực sự khép kín vòng lặp.
uh, it doesn't guarantee your agent writes good code, uh, but it allows them to at least write correct code, uh, which is a big, a really big step forward for being able to trust your agents.
Ừ, nó không đảm bảo agent của bạn viết mã tốt, ừ, nhưng nó cho phép chúng ít nhất viết mã đúng, ừ, đó là một bước tiến lớn, thực sự lớn để có thể tin tưởng các agent của bạn.
Um, I will, I can share one example that we have, uh, within cursor, uh, oops, where let me open this, make this, uh, make me full screen.
Ừm, tôi sẽ, tôi có thể chia sẻ một ví dụ mà chúng tôi có, ừ, trong cursor, ừ, ối, để tôi mở cái này, làm cái này, ừ, làm cho tôi toàn màn hình.
There you go.
Được rồi.
Uh, so for the, for cursor's agent window, uh, so this is actually an
Ừ, vậy đối với, đối với cửa sổ agent của cursor, ừ, vậy đây thực sự là một
interesting story, but, uh, when I joined cursor 5 months ago, uh, they're actually, uh, well, I was supposed to join a different team, I was supposed to join like the cloud agents team, uh, but then since I have a lot of experience working on react and agents window is a react application, uh, I was, uh, I was asked to basically help out with the agent window work.
Câu chuyện thú vị, nhưng, ừ, khi tôi gia nhập cursor 5 tháng trước, ừ, họ thực sự, ừ, à, tôi đáng lẽ phải gia nhập một nhóm khác, tôi đáng lẽ phải gia nhập nhóm agent đám mây, ừ, nhưng sau đó vì tôi có nhiều kinh nghiệm làm việc với react và cửa sổ agent là một ứng dụng react, ừ, tôi đã, ừ, tôi được yêu cầu cơ bản là giúp đỡ với công việc cửa sổ agent.
Uh, but, um,
Ừ, nhưng, ừm,
there wasn't really a lot of like skills to help me.
Thực sự không có nhiều kỹ năng để giúp tôi.
So I just found myself like, okay, uh, agents window is going to launch in like a week, right?
Vậy nên tôi chỉ thấy mình kiểu như, được rồi, ừ, cửa sổ agent sẽ ra mắt trong khoảng một tuần nữa, phải không?
We have a really tight deadline and, um, there was, uh, you know, I was just sitting there like, okay, I'm going to open up the performant, the, the Chrome dev tools and just like take a trace, look at it myself and try to make sense of this flame graph.
Chúng tôi có một thời hạn thực sự gấp rút và, ừm, có, ừ, bạn biết đấy, tôi chỉ ngồi đó kiểu như, được rồi, tôi sẽ mở công cụ dev tools của Chrome, cái, cái hiệu suất, và chỉ lấy một dấu vết, tự xem nó và cố gắng hiểu biểu đồ ngọn lửa này.
And keep
Và hãy
in mind, I was just like in my first week, so I had no idea what I was looking at, no idea where, you know, I mean, I had some idea, but, you know, the codebase was completely fresh to me.
Nhớ rằng, tôi chỉ mới ở tuần đầu tiên, nên tôi không biết mình đang nhìn cái gì, không biết ở đâu, ý tôi là, tôi có chút ý tưởng, nhưng, bạn biết đấy, cơ sở mã hoàn toàn mới với tôi.
Uh, and I realized like my agent had no idea either, you know, like I would take a screenshot of the tree, I would download trace, I would send it to it, and it be like, yeah, it kind of looks like this,
Ừ, và tôi nhận ra rằng agent của tôi cũng không biết gì cả, bạn biết đấy, kiểu như tôi sẽ chụp ảnh màn hình cây, tôi sẽ tải dấu vết xuống, tôi sẽ gửi nó cho nó, và nó sẽ kiểu như, ừ, nó trông giống như thế này,
you know, uh, and it would like confidently state like it's this thing.
Bạn biết đấy, ừ, và nó sẽ tự tin khẳng định kiểu như đó là thứ này.
And then I try to fix that and turns out that's not the actual thing.
Và sau đó tôi cố gắng sửa cái đó và hóa ra đó không phải là thứ thực sự.
So this was a very slow process and if you've ever done any like performance work yourself or, you know, just even development with an agent where you don't have a verification skill, you are the verifier, right?
Vậy nên đây là một quá trình rất chậm và nếu bạn đã từng tự làm bất kỳ công việc hiệu suất nào hoặc, bạn biết đấy, thậm chí chỉ phát triển với một agent mà bạn không có kỹ năng xác minh, bạn là người xác minh, phải không?
You're the bottleneck.
Bạn là nút thắt cổ chai.
You, you tell your agent to do something and then it goes off and write some code, then you open up your, you know, local dev build and then you
Bạn, bạn bảo agent của bạn làm gì đó và sau đó nó đi viết một số mã, rồi bạn mở bản dựng dev cục bộ của mình và sau đó bạn
start to say, oh, you know, doesn't work, then you got to copy paste screen, uh, you know, screenshots or console errors or whatever, uh, and then your agent like slowly kind of like, uh, you know, works with that and then tries to understand it and, um, fix the thing, but then you were constantly just in the loop and being a bottleneck.
Bắt đầu nói, ồ, bạn biết đấy, không hoạt động, rồi bạn phải sao chép dán màn hình, ừ, bạn biết đấy, ảnh chụp màn hình hoặc lỗi console hoặc bất cứ thứ gì, ừ, và sau đó agent của bạn kiểu như từ từ, ừ, bạn biết đấy, làm việc với nó và sau đó cố gắng hiểu nó và, ừm, sửa thứ đó, nhưng sau đó bạn liên tục ở trong vòng lặp và trở thành nút thắt cổ chai.
So there's really no way to parallelize.
Vậy nên thực sự không có cách nào để song song hóa.
So the control glass
Vậy nên kỹ năng control glass