Triển khai các tác nhân cục bộ ở mọi nơi với LFM2.5-2.6B
Giới thiệu LFM2.5-2.6B, cho phép triển khai các tác nhân cục bộ trên nhiều nền tảng khác nhau một cách dễ dàng và hiệu quả.
Giới thiệu LFM2.5-2.6B, cho phép triển khai các tác nhân cục bộ trên nhiều nền tảng khác nhau một cách dễ dàng và hiệu quả.
Giới thiệu LFM2.5-Encoders giúp tối ưu hóa suy luận ngữ cảnh dài nhanh chóng trên CPU.
Giới thiệu Chế độ Xây dựng
Bài viết này giới thiệu Dataframe mới của Gradio.
Gemini 2.5 Flash là mô hình suy luận hoàn toàn kết hợp đầu tiên của chúng tôi, cho phép các nhà phát triển bật hoặc tắt khả năng suy nghĩ.
Giới thiệu HELMET.
Gemini 2.5 Flash của Google giới thiệu 'ngân sách tư duy' giúp cắt giảm chi phí AI tới 600% khi giảm xuống.
Bài viết này kỷ niệm việc Gradio đạt 1 triệu người dùng.
Hugging Face sẽ bán robot mã nguồn mở nhờ việc mua lại Pollen Robotics.
Hugging Face và Cloudflare hợp tác để làm cho giọng nói và video thời gian thực trở nên liền mạch với FastRTC.
Bài viết này thông báo rằng Khóa học NLP đang trở thành Khóa học LLM.
Bài viết này giới thiệu phân tích mới trong Điểm cuối suy luận.
Một phương pháp mới cho phép DeepSeek và các mô hình khác trả lời các câu hỏi 'nhạy cảm'.
Spexi ra mắt mạng lưới phi tập trung LayerDrone để huy động hình ảnh máy bay không người lái độ phân giải cao về Trái đất.
Chúng tôi đã hợp tác với AMD để cung cấp các phiên bản được tối ưu hóa ONNX của dòng sản phẩm Stable Diffusion, được thiết kế để chạy nhanh hơn và hiệu quả hơn trên GPU AMD Radeon™ và APU Ryzen™ AI.
Startup AI này vừa huy động được 7,5 triệu đô la để sửa chữa bảo hiểm thương mại cho 24 triệu doanh nghiệp nhỏ chưa được bảo vệ của Mỹ.
Bài viết này thảo luận về việc tăng tốc suy luận LLM với TGI trên Intel Gaudi.
OpenAI đang phát triển một nền tảng mã hóa mới có tên là Windsurf và dự kiến sẽ tiêu tốn 3 tỷ đô la để xây dựng.
Join our community of enthusiasts and stay informed. Just enter your email below, and we'll make sure you're always in the know!