JEVLAB / FIELD NOTES
Mới từ phòng thí nghiệm
Danh sách đọc theo ngày về các tài nguyên mới được thêm vào và TIN TỨC JEVLAB. Hãy quay lại để xem những gì đã thay đổi hoặc theo dõi nguồn cấp RSS trong trình đọc của riêng bạn.
Ghi nhớ lần truy cập này trên trình duyệt này để làm nổi bật các bổ sung mới vào lần sau. Không đăng nhập hoặc theo dõi trên nhiều thiết bị.
Ngày hiển thị khi một mục có sẵn trong JEVLAB, theo giờ UTC, không phải khi nguồn gốc của nó được xuất bản. Các chỉnh sửa chỉ dành cho dịch thuật không được tính là tài nguyên mới.
15
Cập nhật tính năng học tập tương tác trên Gemini Notebook
Gemini Notebook vừa ra mắt tính năng Interactive Learning Overviews cho tất cả người dùng. Công cụ này giúp chuyển đổi tài liệu thành không gian học tập tương tác, tích hợp tóm tắt và nội dung liên quan.
threads.comCập nhật về ChatGPT từ Choi
Choi thông báo về một đợt thiết lập lại hệ thống ChatGPT và gợi ý rằng những thay đổi quan trọng sắp diễn ra. Người dùng được khuyến khích theo dõi các thông tin mới nhất từ nguồn này.
threads.comWhite Circle ra mắt Halo cho huấn luyện hậu kỳ AI
White Circle đã giới thiệu Halo, một khung làm việc mới hỗ trợ tinh chỉnh và học tăng cường cho các mô hình AI mã nguồn mở. Công cụ này tối ưu hóa hiệu suất và đơn giản hóa quy trình thiết lập huấn luyện thông qua cấu hình YAML.
threads.comHermes Agent khôi phục hỗ trợ đăng ký Claude
Hermes Agent đã khôi phục khả năng sử dụng đăng ký Claude thông qua một plugin chính thức mới. Thay đổi này cho phép người dùng kết nối trực tiếp với Claude Code CLI thay vì sử dụng SDK bên ngoài.
threads.comtypesafe-sdk-ruby
SDK Ruby do cộng đồng duy trì này cung cấp giao diện cho API TypeSafe AI. Nó cho phép các nhà phát triển thực hiện phân loại và định tuyến dữ liệu có cấu trúc bằng cách xác định các câu hỏi có kiểu, quản lý thử lại và xử lý lỗi API trong ứng dụng Ruby.
github.comUnitree ra mắt bàn tay robot Dex5-S
Unitree vừa giới thiệu Dex5-S, một bàn tay robot có kích thước tương đương bàn tay người với khả năng vận động linh hoạt. Sản phẩm này đánh dấu bước tiến mới trong việc thương mại hóa các bộ phận thao tác cho robot với mức giá khởi điểm 6.500 USD.
threads.comMeta công bố cáp quang xuyên Đại Tây Dương Petal
Meta vừa giới thiệu dự án cáp ngầm Petal với khả năng truyền tải dữ liệu đạt mức petabit mỗi giây. Hệ thống này dự kiến sẽ nâng cấp đáng kể hạ tầng mạng toàn cầu phục vụ cho các trung tâm dữ liệu AI khi đi vào hoạt động năm 2029.
threads.compi-jev-sentinel
Công cụ này đóng vai trò là người bảo vệ an ninh cho các tác nhân lập trình bằng cách sử dụng Jev để đánh giá các lệnh gọi công cụ, đầu ra và phản hồi. Nó giúp phát hiện tiêm lệnh, xóa thông tin bí mật và ghim tác vụ để đảm bảo tương tác an toàn hơn.
github.comTypeSafeAI
TypeSafeAI là một SDK .NET dành cho TypeSafe AI System One. Nó cung cấp một API có kiểu dữ liệu an toàn và tiện dụng, hỗ trợ NativeAOT, xử lý theo lô và tích hợp với Microsoft.Extensions.AI để định tuyến và đánh giá.
github.comMáy phát hiện nói dối cảm xúc jevtest
Công cụ này minh họa các mô hình TypeSafe Jev bằng cách phân tích các ẩn ý cảm xúc theo thời gian thực. Nó so sánh khả năng phân loại xác suất của Jev với các LLM tiêu chuẩn, cho thấy cách Jev cung cấp điểm tin cậy có cấu trúc và tiềm năng cải thiện độ trễ và chi phí cho các tác vụ ra quyết định.
github.comjev-lint
jev-lint là một công cụ sử dụng bộ phân loại Jev để xác định các điểm không nhất quán về logic giữa mã nguồn và tài liệu đi kèm. Nó kết hợp các bộ khớp ast-grep với các truy vấn ngôn ngữ tự nhiên để phát hiện các vấn đề như chú thích gây hiểu lầm, đặt tên sai và các đường dẫn lỗi ẩn.
github.comJev với các tác nhân lập trình
Tài liệu này làm rõ rằng Jev là một mô hình Hệ thống Một dành cho việc ra quyết định có cấu trúc, không phải là một LLM tạo văn bản. Nó hướng dẫn các nhà phát triển cách tích hợp Jev cùng với các tác nhân lập trình cho các tác vụ như phân loại, chấm điểm và định tuyến.
docs.typesafe.aiTerence Tao cảnh báo về hướng phát triển của AI
Nhà toán học Terence Tao cho rằng các công ty AI cần ưu tiên khả năng giải thích thay vì chỉ tập trung vào kết quả. Ông cảnh báo việc chạy theo các chỉ số điểm số mà thiếu sự kiểm chứng là thiếu trách nhiệm.
threads.comXiaomi ra mắt mô hình MiMo-V2.6
Xiaomi vừa công bố dòng mô hình MiMo-V2.6 với khả năng đa phương thức mạnh mẽ và chi phí vận hành thấp. Các mô hình này đạt điểm số cao trên bảng xếp hạng Artificial Analysis, đồng thời cung cấp mã nguồn và môi trường huấn luyện mở.
threads.comOpenAI đạt bước tiến lớn trong nghiên cứu toán học
OpenAI thông báo mô hình nội bộ mới đã giải quyết hơn 100 bài toán toán học lâu đời. Hệ thống sử dụng khoảng 10.000 tác nhân AI phối hợp để đạt được kết quả này chỉ trong 24 ngày.
threads.com
21
Sự phát triển phi tuyến tính của trí tuệ nhân tạo
Theo Choi, sự tiến bộ của AI đang diễn ra nhanh hơn nhiều so với các dự đoán trước đây. Việc tích hợp AI vào chính quá trình nghiên cứu và phát triển đang đẩy nhanh tốc độ tiến tới điểm kỳ dị.
threads.comjev-mcp
Máy chủ MCP này tích hợp các mô hình Jev của TypeSafe vào các tác nhân AI, cung cấp các đầu ra có cấu trúc như phán đoán có/không, lựa chọn nhiều phương án và chấm điểm dựa trên tiêu chí. Nó cho phép các tác nhân thực hiện đánh giá dữ liệu trực tiếp và có kiểu trong quy trình làm việc.
github.comspring-ai-typesafe
SDK Java này tích hợp API JEV của TypeSafe AI với Spring AI. Nó cung cấp các nguyên hàm ra quyết định có cấu trúc như Noul, Choice và Score, cho phép triển khai LLM-as-a-judge, guardrail và hậu xử lý RAG mà không cần dựa vào tạo văn bản truyền thống.
github.comtypesafe-sdk-go
SDK Go này cung cấp một giao diện có cấu trúc để tương tác với các dịch vụ TypeSafe AI. Nó cho phép các nhà phát triển thực hiện đánh giá bằng cách sử dụng các câu hỏi lựa chọn, điểm số và boolean, đồng thời quản lý cấu hình máy khách, thử lại và ghi nhật ký.
github.comClient Ruby cho jev
Thư viện Ruby này cung cấp một client cho API mô hình Jev. Nó cho phép các nhà phát triển thực hiện các truy vấn song song bằng cách sử dụng các phương pháp đánh giá dựa trên sự thật, lựa chọn và thang điểm để cấu trúc việc ra quyết định bằng AI.
github.comTypeSafe.AI.Sdk for .NET
Client .NET do cộng đồng phát triển này cung cấp giao diện định kiểu cho các dịch vụ TypeSafe AI. Nó phản ánh chức năng của SDK JavaScript chính thức, cho phép các nhà phát triển triển khai các quy trình hỏi đáp có cấu trúc trong ứng dụng .NET của họ.
github.comjev-mailroom
Bằng chứng khái niệm này trình bày một hệ thống phân loại email tự động sử dụng Jev để phân loại tin nhắn theo loại và danh mục. Nó xử lý email qua IMAP, sử dụng các câu hỏi song song để xác định nhãn trong khi quản lý logic và ngưỡng trong Python.
github.comNitro
Nitro tối ưu hóa Grok Build bằng cách sử dụng Jev để lọc danh sách công cụ mỗi lượt. Điều này giúp giảm mức sử dụng token và chi phí bằng cách thu hẹp các công cụ khả dụng trước khi thực thi, đồng thời duy trì hiệu quả bộ nhớ đệm prompt.
github.comswift-typesafe
SDK Swift 6.4 này cung cấp một client an toàn về kiểu dữ liệu cho TypeSafe AI, tuân theo API 0.7.0 của Python. Nó cho phép tương tác có cấu trúc với các mô hình AI bằng cách sử dụng các macro Swift để xác định lược đồ câu hỏi và câu trả lời.
github.comtypesafe-sdk-php
SDK PHP do cộng đồng duy trì này cung cấp một client cho API System One của TypeSafe AI. Nó cho phép thực hiện các truy vấn có kiểu, quản lý các yêu cầu bất đồng bộ thông qua Guzzle promises, và cấu hình thử lại và ghi nhật ký.
github.comsqlite3-jev
Tiện ích mở rộng SQLite này cho phép tích hợp trực tiếp với TypeSafe Jev, giúp người dùng thực hiện các tác vụ AI dựa trên quyết định như phân loại, chấm điểm và kiểm tra xác suất có/không ngay trong các truy vấn SQL bằng cách sử dụng các lệnh gọi hàm dựa trên libcurl.
github.comSmartMoney-Cub
SmartMoney-Cub là một nhật ký giao dịch và công cụ đánh giá chỉ đọc sử dụng Jev để phân tích bằng chứng tài chính. Nó giúp các nhà giao dịch đánh giá quyết định và phát triển chiến lược thông qua các vòng lặp phản hồi ngoại tuyến mà không thực hiện lệnh giao dịch.
github.comProgressGate
ProgressGate là một công cụ phát hiện sự đình trệ về ngữ nghĩa trong các vòng lặp của tác nhân bằng cách phân tích quỹ đạo với Jev. Nó cung cấp các quyết định mang tính xác định như CONTINUE, WARN, REPLAN hoặc HALT để ngăn chặn tác nhân lặp lại các giả định sai lầm.
github.comĐiểm chuẩn trích xuất lịch sử hút thuốc
Kho lưu trữ này cung cấp một điểm chuẩn để so sánh Jev và OpenAI trong việc trích xuất lịch sử hút thuốc từ 1.000 ghi chú y tế tổng hợp. Nó đánh giá độ chính xác, chi phí và độ trễ bằng cách sử dụng quy trình chọn ứng viên chung.
github.comjev-agent-browser
jev-agent-browser cung cấp môi trường thực thi giới hạn cho các tác nhân trình duyệt bằng cách tích hợp Jev với agent-browser. Nó cho phép lựa chọn hành động có kiểu và điều phối tác vụ có cấu trúc, giúp các tác nhân chính ủy quyền duyệt web và nghiên cứu một cách an toàn.
github.comego-jev
ego-jev cung cấp một vòng lặp nội bộ cho ego lite sử dụng TypeSafe System One. Nó thay thế các lượt LLM tiêu chuẩn bằng một quyết định được định kiểu duy nhất cho mỗi bước DOM, nhằm cải thiện hiệu suất của tác nhân trình duyệt bằng cách giảm độ trễ trong các tác vụ web tương tác.
github.comego-jev
ego-jev tích hợp mô hình Jev System One vào trình duyệt ego-lite để tự động hóa các tác vụ trong một quy trình duy nhất. Nó cho thấy tốc độ nhanh gấp 2 lần so với các vòng lặp LLM thông thường nhờ sử dụng bảng phần tử được lập chỉ mục.
github.comjev-leftpad
Dự án này minh họa cách sử dụng Jev không theo quy ước để thực hiện việc đệm chuỗi bên trái. Đây là một ví dụ hài hước về việc kỹ thuật quá mức cho một tác vụ mà các hàm thư viện tiêu chuẩn có thể xử lý dễ dàng.
github.comjev-docs-zh
Dự án này cung cấp bản dịch tiếng Trung cho tài liệu chính thức của mô hình Jev từ TypeSafe AI. Nó bao gồm các khái niệm về System One và các nguyên hàm Choice, Score, Noul, cùng công cụ tạo trang web tĩnh để đọc ngoại tuyến.
github.comAsyncTypeSafeClient
Tài nguyên này ghi lại AsyncTypeSafeClient cho Python, cho phép tương tác bất đồng bộ với API TypeSafe AI. Nó trình bày chi tiết các tham số cấu hình, thiết lập ghi nhật ký và các phương thức để quản lý mô hình và thực thi các truy vấn hệ thống.
docs.typesafe.aiSpaceXAI ra mắt Grok 4.7
SpaceXAI đã phát hành Grok 4.7 với trọng tâm là cải thiện khả năng lập trình và xử lý tác vụ dài hạn thông qua học tăng cường. Mặc dù hiệu suất trong các công việc cụ thể tăng lên, nhưng điểm số trí tuệ tổng thể của mô hình chỉ cải thiện khiêm tốn so với phiên bản trước.
threads.com










