Arama · son güncelleme 6 sa önce
1-10 / 10 haber Sayfa 1 / 1
Teknoloji & Yapay Zeka
12 Aug

Robotları Test Etmek İçin Evrensel Platform: RoboDojo

Hong Kong Üniversitesi'ndeki araştırmacılar, yapay zeka destekli robotların yeteneklerini hem sanal hem de gerçek ortamlarda ölçebilen 'RoboDojo' adlı kapsamlı bir değerlendirme platformu geliştirdi. Yaklaşık 20 önde gelen üniversitenin iş birliğiyle hayata geçirilen bu platform, somutlaşmış yapay zeka (embodied AI) alanındaki en önemli zorluklardan birini hedef alıyor: farklı araştırma gruplarının geliştirdiği robot sistemlerini ortak ve adil bir zemine taşımak. Bugüne kadar robotik manipülasyon alanında kullanılan test ortamları birbirinden kopuk ve karşılaştırması güçtü; bu durum hem ilerlemeyi ölçmeyi hem de sonuçları yeniden üretmeyi zorlaştırıyordu. RoboDojo, simülasyon ile fiziksel dünya arasındaki bu köprüyü kurarak araştırmacılara standart bir ölçüt sunmayı amaçlıyor. Çalışma henüz hakemli bir dergide yayımlanmamış olup arXiv ön baskı sunucusunda paylaşılmış durumda; dolayısıyla bulgular bağımsız doğrulama sürecini henüz tamamlamamıştır. Yine de projenin küresel iş birliği boyutu ve ele aldığı metodolojik sorun, robotik yapay zeka araştırmaları için önemli bir adım olarak değerlendiriliyor.

TechXplore — Robotics 0
İklim & Çevre
27 Jul

Yapay Zeka Hava Durumu Modellerini Kendi Kendine Ayarlıyor

Hava durumu ve iklim tahmin modelleri, atmosferin küçük ölçekli süreçlerini temsil etmek için 'parametrizasyon' adı verilen matematiksel şemalar kullanır. Bu şemalardaki katsayılar genellikle elle ayarlanır ve modelin gerçek atmosfere tam uyum sağlamasını zorlaştırır. Yeni bir araştırma, bu sabit katsayıların yerine pekiştirmeli öğrenme (RL) algoritmaları kullanarak modelin anlık durumuna göre dinamik olarak güncellenen fonksiyonlar geliştirdi. Yaklaşım; basit iklim yanlılığı düzeltmesi, radyatif-taşınımsal denge ve enerji denge modeli gibi farklı test ortamlarında denendi. Dokuz farklı RL algoritması karşılaştırıldığında, TQC, DDPG ve TD3 algoritmalarının en kararlı ve başarılı sonuçları verdiği görüldü. Hem tek ajanlı hem de çok ajanlı federe yapılar test edilerek yaklaşımın ölçeklenebilirliği de sınanmış oldu. Bu çalışma, iklim modellerindeki sistematik hataların azaltılmasına yönelik umut verici bir yol haritası sunuyor.

arXiv — Atmosfer & Okyanus Bilimleri 0
Teknoloji & Yapay Zeka
17 Jun

Sanctuary AI, fiziksel yapay zekâyı otomotiv üretiminde kanıtladı

Yapay zekâ şirketi Sanctuary AI, insansı robot geliştirme sürecini beklemeksizin fiziksel yapay zekâ teknolojisini gerçek bir üretim ortamında test etmeye başladı. Şirket, Tier 1 düzeyinde bir otomotiv tedarikçisiyle yürüttüğü iş birliği kapsamında robotik sistemlerinin fabrika koşullarında ne ölçüde başarılı olduğunu ölçümledi. Bu adım, sektörde 'fiziksel yapay zekâ' olarak adlandırılan; yani robotların gerçek dünya görevlerini öğrenip yerine getirebilme kapasitesinin endüstriyel ölçekte doğrulanması açısından önemli bir kilometre taşı niteliği taşıyor. Sanctuary AI'ın yaklaşımı, çoğu rakibinin benimsediği 'önce insansı robot geliştir, sonra uygula' stratejisinden ayrışıyor: Şirket mevcut teknoloji altyapısını doğrudan üretim hattına entegre ederek performansını somut verilerle ortaya koymayı tercih ediyor. Otomotiv sektörü, yüksek hassasiyet gereksinimleri ve sıkı kalite standartları nedeniyle robotik sistemler için en zorlu test ortamlarından birini oluşturuyor. Bu bağlamda söz konusu doğrulama çalışması, fiziksel yapay zekânın yalnızca laboratuvar koşullarında değil, gerçek sanayi süreçlerinde de işlevsel olabileceğini göstermesi bakımından dikkat çekiyor.

The Robot Report 0
Teknoloji & Yapay Zeka
1 May

WebMall: Çoklu Mağaza Ortamında Web Ajanlarını Test Eden Yeni Benchmark

Araştırmacılar, yapay zeka destekli web ajanlarının performansını değerlendirmek için WebMall adında yeni bir benchmark geliştirdi. Mevcut test ortamları sadece tek mağazalarda basit alışveriş görevlerini kapsarken, WebMall farklı mağazalardan ürün karşılaştırması yapıp en uygun fiyatı bulma gibi karmaşık görevleri simüle ediyor. Bu sistem, LLM tabanlı web ajanlarının gerçek dünyada karşılaştırmalı alışveriş yapabilme yeteneklerini ölçmek için tasarlandı. WebMall, heterojen ürün verilerine sahip çoklu mağaza ortamını taklit ederek, ajanların daha zorlu ve gerçekçi e-ticaret görevlerini yerine getirmelerini test ediyor. Bu gelişme, web otomasyonu alanında önemli bir eksikliği gideriyor.

arXiv — Hesaplamalı Dilbilim (cs.CL) 0
Teknoloji & Yapay Zeka
29 Apr

Otonom araçlar için gerçekçi sürüş simülatörü geliştirildi

Araştırmacılar, otonom araçların test edilmesi için yeni bir dünya modeli geliştirdi. ReSim adlı bu sistem, gerçek sürüş verilerini simülatör verileriyle birleştirerek daha güvenilir test ortamları yaratıyor. Geleneksel modeller sadece uzman sürücülerin güvenli davranışlarını öğrendiği için tehlikeli veya acemi sürüş durumlarını simüle etmekte zorlanıyordu. Yeni yaklaşım, CARLA gibi sürüş simülatörlerinden toplanan çeşitli veriyi gerçek dünya örnekleriyle harmanlayarak bu sorunu çözüyor. Difüzyon transformatör mimarisi kullanan video üretici model, kontrol sinyallerini etkili şekilde entegre ederek tahmin doğruluğunu artırıyor. Bu gelişme, otonom araç politikalarının değerlendirilmesi ve çeşitli sürüş senaryolarının test edilmesi açısından önemli bir adım.

arXiv (Robotik) 0
Teknoloji & Yapay Zeka
21 Apr

Yapay Zeka Ajanları İçin Yeni Beceri Yönetim Sistemi: GraSP

Araştırmacılar, yapay zeka ajanlarının performansını artırmak için GraSP adlı yenilikçi bir sistem geliştirdi. Çalışma, AI ajanlarına daha fazla beceri kazandırmanın her zaman daha iyi sonuç vermediğini, asıl sorunun becerileri doğru şekilde organize etmek olduğunu ortaya koyuyor. Geliştirilen sistem, becerileri graf yapısında düzenleyerek ajanların hangi beceriyi ne zaman kullanacağını daha akıllı bir şekilde belirlemesini sağlıyor. GraSP, becerileri birbirine bağlı düğümler halinde organize ederek, ajanların karmaşık görevleri daha verimli çözmesine olanak tanıyor. Sistem, çeşitli test ortamlarında başarıyla denenmiş ve geleneksel yaklaşımlara kıyasla önemli performans artışları sağlamış. Bu gelişme, yapay zeka ajanlarının daha karmaşık gerçek dünya problemlerini çözmesinde önemli bir adım olarak değerlendiriliyor.

arXiv (CS + AI) 0
Teknoloji & Yapay Zeka
21 Apr

Optik İletişimde Yeni Spektrum Optimizasyonu ile Veri Aktarım Hızı Rekoru

Araştırmacılar, optik fiber ağlarında veri aktarım hızını maksimum seviyeye çıkaran yeni bir spektrum yapılandırma sistemi geliştirdi. Bu sistem, modülasyon formatı, sembol hızı ve dalga boyu seçici anahtarların bant genişliği gibi parametreleri eş zamanlı optimize ederek hem iletim kalitesini garanti altına alıyor hem de throughput'u artırıyor. Metro ölçekli test ortamlarında doğrulanan bu teknoloji, sınırlı spektrum genişliği içinde maksimum veri kapasitesi elde etmeyi mümkün kılıyor. Özellikle Optik Spektrum Hizmeti (OSaaS) uygulamalarında önemli performans artışları sağlayabileceği gösterilen bu yenilik, gelecek nesil fiber optik ağların verimliliğini önemli ölçüde artırma potansiyeli taşıyor.

arXiv (CS + AI) 0
Teknoloji & Yapay Zeka
21 Apr

Yapay zeka ajanları için otomatik çevre üretimi: ClawEnvKit sistemi geliştirildi

Araştırmacılar, pençe benzeri robotik ajanların eğitimi için manuel olarak hazırlanan test ortamları sorununun çözümüne yönelik yenilikçi bir sistem geliştirdi. ClawEnvKit adlı bu otonom pipeline, doğal dil açıklamalarından hareketle çeşitli ve doğrulanmış sanal ortamları otomatik olarak üretebiliyor. Sistem üç temel modülden oluşuyor: doğal dili yapısal parametrelere dönüştüren bir ayrıştırıcı, görev tanımları ve araç arayüzleri üreten bir jeneratör, ve ortamların tutarlılığını kontrol eden bir doğrulayıcı. Bu teknoloji kullanılarak 24 farklı kategoride 1.040 ortam içeren Auto-ClawEval benchmark'ı oluşturuldu. Bu gelişme, robotik ajanların test edilmesi ve değerlendirilmesi sürecini önemli ölçüde hızlandıracak ve ölçeklenebilir hale getirecek.

arXiv (CS + AI) 0
Teknoloji & Yapay Zeka
20 Apr

Yapay Zeka, İlaç Tasarımında Ne Kadar Başarılı? Yeni Test Sonuçları

Araştırmacılar, büyük dil modellerinin küçük molekül ilaç tasarımındaki yeteneklerini değerlendiren kapsamlı bir çalışma gerçekleştirdi. Çalışmada moleküler özellik tahmini, moleküler temsil dönüşümleri ve molekül tasarımı gibi kimyasal görevleri kapsayan test ortamları geliştirildi. Sonuçlar, en gelişmiş AI modellerinin kimyasal görevlerde giderek daha başarılı olduğunu, ancak özellikle sınırlı veri bulunan deneysel ortamlarda hala önemli gelişim alanları bulunduğunu ortaya koydu. Pekiştirmeli öğrenme yöntemiyle ek eğitim verilen modellerin performansında belirgin iyileşmeler gözlemlendi.

arXiv (CS + AI) 0
Teknoloji & Yapay Zeka
16 Apr

Büyük Dil Modelleri Karmaşık Mantık Sorunlarında Sınırlarına Çarpıyor

Araştırmacılar, büyük dil modellerinin (LLM) mantıksal akıl yürütme yeteneklerini sistematik olarak test eden kapsamlı bir çalışma yürüttü. Sudoku, Hanoi Kulesi ve Rubik Küpü gibi dokuz klasik mantık problemiyle yapılan testlerde, modellerin problem karmaşıklığı arttıkça performanslarının belirgin şekilde düştüğü gözlemlendi. Çalışma, mevcut değerlendirme yöntemlerinin yetersizliğini ortaya koyarak, modellerin gerçek akıl yürütme kapasitelerini ölçmek için kontrollü test ortamları geliştirdi. Bu bulgular, yapay zeka sistemlerinin karmaşık mantıksal problemlerde henüz önemli sınırlarının bulunduğunu gösteriyor.

arXiv (CS + AI) 0