AI News Topics
computer vision
8 concise briefings covering computer vision.
Hugging Face Blog
17 Jul 2026
Hugging Face and NVIDIA announced integration between NeMo Automodel and the Diffusers library to simplify fine-tuning of video and image models at scale. The collaboration provides tools and workflows aimed at accelerating model customization on large datasets.
OpenAI News
17 Jun 2020
OpenAI melaporkan bahawa model transformer besar yang dilatih pada urutan piksel boleh menghasilkan sambungan imej dan sampel yang koheren. Mereka juga menemui korelasi antara kualiti sampel dan ketepatan klasifikasi imej, dengan model generatif terbaik menampilkan ciri kompetitif berbanding rangkaian konvolusi dalam tetapan tanpa penyeliaan.
OpenAI News
05 Jan 2021
OpenAI memperkenalkan CLIP, rangkaian neural yang belajar konsep visual melalui supervisi bahasa semula jadi. Ia boleh digunakan untuk mana-mana penanda aras klasifikasi visual dengan hanya memberikan nama kategori, meniru keupayaan "zero-shot" GPT-2 dan GPT-3.
IEEE Spectrum
09 Feb 2022
Andrew Ng mengusulkan gerakan data-centric AI — memfokuskan kejuruteraan data berkualiti, pelabelan konsisten dan penggunaan data sintetik untuk model yang lebih cekap. Melalui Landing AI dan platform LandingLens beliau mempromosi penyelesaian ‘small data’ untuk pemeriksaan visual industri dan alat yang membolehkan pengilang melatih serta menyelenggara model sendiri.
Hugging Face Blog
17 Mar 2022
Hugging Face Blog menerangkan langkah-langkah untuk melatih semula (fine-tune) model segmentasi semantik menggunakan set data tersuai. Panduan itu nampak merangkumi persediaan dataset, konfigurasi latihan dan contoh kod untuk mengaplikasikan model pada data khusus pengguna.
Hugging Face Blog
19 Aug 2022
Hugging Face Blog menerangkan cara menyebarkan model Vision Transformer (ViT) pada Vertex AI. Artikel itu memberi panduan praktikal dan menekankan pertimbangan konfigurasi serta persekitaran awan.
Hugging Face Blog
16 Jan 2025
Menurut Hugging Face Blog, mereka mengumumkan integrasi yang membolehkan model timm digunakan terus dalam rangka kerja Transformers. Integrasi ini memudahkan pemaju menggabungkan model penglihatan timm dengan alat dan aliran kerja Transformers untuk pembangunan dan ujian.
Google DeepMind Blog
16 Jan 2026
DeepMind memperkenalkan D4RT, sistem seragam untuk pembinaan dan penjejakan 4D yang dikatakan sehingga 300 kali lebih pantas daripada kaedah terdahulu. Menurut entri blog Google DeepMind, reka bentuknya memberi tumpuan pada keberkesanan dan kelajuan pemprosesan untuk penggunaan masa nyata.